Thời đại ném thêm nhiều GPU vào mọi bài toán AI có thể đang chạm tới giới hạn. AMD đang lập luận rằng AI tác nhân—thế hệ AI tiếp theo có khả năng suy luận, lập kế hoạch và thực hiện hành động một cách tự chủ trong thế giới thực—cần một kiến trúc phần cứng hoàn toàn khác biệt so với các chatbot và trình tạo hình ảnh đã định nghĩa làn sóng đầu tiên.
Luận điểm cốt lõi thật ấn tượng vì sự đơn giản của nó: trong khi các tác vụ suy luận và huấn luyện AI truyền thống thường chạy trên các cấu hình máy chủ với tỷ lệ CPU-GPU là 1:4 hoặc thậm chí 1:8, thì AI tác nhân hoàn toàn đảo ngược phương trình này. Phân tích kỹ thuật của AMD, được công bố qua một loạt bài viết vào giữa năm 2026, kêu gọi một tỷ lệ gần với 1:1 hoặc thậm chí là các thiết lập ưu tiên CPU.
Tại sao AI dạng tác nhân lại tốn nhiều CPU
Để hiểu tại sao điều này quan trọng, hãy xem xét những gì AI mang tính tác nhân thực sự làm. Khác với chatbot chỉ nhận một lệnh đầu vào, chạy qua mô hình và đưa ra phản hồi, một hệ thống tác nhân điều phối nhiều quy trình cùng lúc. Nó có thể đang phối hợp hàng chục tác nhân con, quản lý các lời gọi công cụ, phân tích các luồng dữ liệu thời gian thực, đưa ra quyết định và thực hiện hành động, tất cả cùng một lúc.
Đáp ứng nhu cầu này, AMD đã ra mắt dòng bộ xử lý EPYC 9005. Những con chip này tích hợp lên đến 192 lõi và 384 luồng, mang đến mật độ lõi cần thiết để chạy các tác vụ điều phối tác nhân song song quy mô lớn. Kiến trúc bộ xử lý “Venice” sắp tới dự kiến sẽ nâng giới hạn này lên 256 lõi và 512 luồng.
Trò chơi toàn diện
AMD không đang định vị đây là câu chuyện chỉ dành cho CPU. Tầm nhìn rộng hơn của công ty đối với cơ sở hạ tầng AI tác nhân bao gồm các bộ tăng tốc Instinct cho phần tính toán GPU vẫn cần thiết, cùng với công nghệ mạng Pensando để xử lý lưu lượng dữ liệu khổng lồ mà các hệ thống này yêu cầu.
Về phía người tiêu dùng và nhà phát triển, AMD cũng đang nhắm đến thị trường phát triển AI tác nhân địa phương thông qua các nền tảng Ryzen AI. Ryzen AI Max+ 395, có sẵn qua các nhà bán lẻ như Micro Center tính đến tháng 7 năm 2026, giúp các nhà phát triển có khả năng xây dựng và kiểm thử các hệ thống AI tác nhân trên phần cứng của riêng họ trước khi triển khai quy mô trung tâm dữ liệu.
Điều này có nghĩa gì đối với các nhà đầu tư
Thuyết đầu tư ở đây đơn giản nhưng có tiềm năng đáng kể. Nếu AMD đúng khi cho rằng AI mang tính tác nhân đòi hỏi tỷ lệ 1:1 giữa CPU và GPU thay vì các cấu hình hiện tại ưu tiên GPU, thì thị trường mục tiêu tổng thể cho các CPU máy chủ có nhiều lõi có thể tăng lên đáng kể.
Agentic AI thay đổi phép toán. Nếu mỗi GPU trong việc triển khai Agentic AI cần một lượng CPU tương đương nằm cạnh nó, kinh doanh CPU máy chủ EPYC của AMD trở thành bên hưởng lợi trực tiếp từ chi tiêu vào cơ sở hạ tầng AI. AMD hiện đang sản xuất các bộ xử lý 192 lõi và có các chip 256 lõi trong lộ trình phát triển.
