NVIDIA Vera Rubin CPU bắt đầu sản xuất hàng loạt, nhắm vào cơ sở hạ tầng AI

iconMetaEra
Chia sẻ
AI summary iconTóm tắt
CPU NVIDIA Vera Rubin NVL72 đã bước vào sản xuất hàng loạt, với hơn 300 đối tác và hơn 350 nhà máy tại 30 quốc gia tham gia. Chip này sở hữu 88 lõi Olympus và đã được giao đến các khách hàng như OpenAI và SpaceX. Khi chỉ số nỗi sợ và tham lam cho thấy sự gia tăng niềm tin thị trường, NVIDIA đang đẩy mạnh các hệ thống full rack sử dụng CPU tùy chỉnh để cạnh tranh với Intel và AMD. Các altcoin cần theo dõi có thể có biến động khi nhu cầu về cơ sở hạ tầng AI tăng lên.
NVIDIA Vera Rubin NVL72 đã bước vào giai đoạn tăng sản lượng hàng loạt, với chuỗi cung ứng bao phủ hơn 350 nhà máy và 30 quốc gia, cùng sự tham gia của hơn 300 đối tác. Các chip Vera đã được giao cho các khách hàng như OpenAI, Anthropic và SpaceX, dự kiến sẽ giao hơn 1,3 triệu con trong năm nay, với giá trung bình khoảng 5.000 USD mỗi con. NVIDIA đang mở rộng cuộc cạnh tranh từ thị trường GPU sang thị trường CPU, đặt cược vào các tác nhân AI sẽ tạo ra “thời khắc CPU” mới, với quy mô thị trường CPU máy chủ lâu dài có thể đạt 200 tỷ USD. Vera sử dụng 88 lõi Olympus, nhấn mạnh hiệu năng luồng đơn thay vì số lượng lõi, có thể đạt tốc độ gấp 1,8 lần so với CPU x86 trong các nhiệm vụ cụ thể. NVIDIA không còn chỉ bán chip mà còn bán hệ thống kệ máy chủ hoàn chỉnh tích hợp chip tự phát triển, trực tiếp đe dọa lợi ích cốt lõi của AMD và Intel trên thị trường CPU máy chủ.

Tác giả bài viết, nguồn: Tencent News

NVIDIA đang lan rộng cuộc chiến từ thị trường GPU sang CPU.

Ngay trước khi AMD tổ chức sự kiện liên quan đến AI, NVIDIA đã công bố chi tiết về tiến độ mới nhất của nền tảng Vera Rubin thế hệ tiếp theo vào thứ Ba, ngày 21 theo giờ Đông Mỹ: Vera Rubin NVL72 đã bước vào giai đoạn tăng công suất sản xuất hàng loạt. NVIDIA cho biết chuỗi cung ứng của nền tảng này bao gồm hơn 350 nhà máy và 30 quốc gia trên toàn cầu, với hơn 300 đối tác đã tham gia.

Đồng thời, NVIDIA đã công bố thêm dữ liệu hiệu suất của Vera CPU và nền tảng Vera Rubin trong các tải công việc AI agent, nhằm chứng minh rằng khi AI chuyển từ “trả lời câu hỏi” sang lập kế hoạch tự chủ, gọi công cụ và thực hiện nhiệm vụ, CPU đang trở thành chiến trường mới trong cơ sở hạ tầng AI.

Các thông số đầy đủ, kết quả kiểm tra hiệu năng và thông tin kiến trúc của sản phẩm CPU trung tâm dữ liệu Vera do NVIDIA công bố là dữ liệu thiết yếu để khách hàng tiềm năng đánh giá toàn diện chip này. Công ty cho biết, chip Vera đã được giao cho các khách hàng như OpenAI, Anthropic và SpaceX vào tháng 6.

Vera ra mắt, là bước mới nhất trong chiến lược tích hợp dọc của NVIDIA. Công ty nhằm mục tiêu bán cho khách hàng các hệ thống máy chủ hoàn chỉnh tích hợp chip tự phát triển, thay vì chỉ bán từng con chip đơn lẻ. Theo ước tính của Wolfe Research, giá trung bình mỗi con chip Vera vào khoảng 5.000 USD, với dự kiến sản lượng giao hàng năm nay khoảng 1,3 triệu con. Đối với AMD và Intel, hành động này của NVIDIA trực tiếp đe dọa lợi ích cốt lõi của hai công ty này trên thị trường CPU máy chủ.

Đây không phải là lần đầu tiên NVIDIA thông báo Vera CPU bước vào sản xuất hàng loạt. Cuối tháng 5 năm nay, NVIDIA đã thông báo Vera đã bước vào giai đoạn sản xuất toàn diện và cho biết chip này có thể thực hiện các nhiệm vụ cụ thể nhanh gấp 1,8 lần so với CPU x86 truyền thống. Vào giữa tháng 5, NVIDIA còn giao hệ thống Vera CPU đầu tiên cho các khách hàng như Anthropic, OpenAI và SpaceX AI. Lần thông báo này nhấn mạnh hơn vào việc tăng tốc sản xuất toàn bộ nền tảng Vera Rubin, triển khai cho khách hàng và hiệu suất trong môi trường sản xuất thực tế.

Sự trỗi dậy của các tác nhân AI, CPU trở lại là “điểm nghẽn then chốt”

Lý do cốt lõi mà NVIDIA đầu tư vào CPU là các ứng dụng AI đang thay đổi.

Nhiệm vụ chính của AI tạo sinh truyền thống là tạo ra câu trả lời dựa trên đầu vào của người dùng, GPU đảm nhận tính toán mô hình quy mô lớn, trong khi CPU chủ yếu phụ trách các công việc điều phối tương đối ngoại vi. Tuy nhiên, với sự phát triển nhanh chóng của các tác nhân AI, hệ thống AI bắt đầu tự động phân tách nhiệm vụ, gọi các công cụ bên ngoài, chạy mã, truy cập dữ liệu và đánh giá kết quả lặp đi lặp lại.

Trong quá trình này, CPU cần xử lý thường xuyên nhiều tác vụ có độ trễ thấp và yêu cầu thời gian thực. NVIDIA cho rằng, các đại lý AI không chỉ dựa vào GPU để thực hiện tải công việc: mỗi môi trường chạy, gọi công cụ, sắp xếp tác vụ và truy xuất dữ liệu ngữ cảnh dài của đại lý đều cần sự tham gia của CPU.

Khi phát hành Vera, NVIDIA đã chỉ ra rằng AI đại lý đang tạo ra một “thời điểm CPU” mới. Họ cho rằng, khi các hệ thống AI chuyển từ “trả lời câu hỏi” sang “hành động”, vai trò của CPU trong toàn bộ nhà máy AI sẽ tăng rõ rệt.

NVIDIA thậm chí dự đoán quy mô thị trường CPU máy chủ dài hạn có thể đạt 200 tỷ USD. Con số này trông cực kỳ táo bạo so với thị trường CPU máy chủ truyền thống, nhưng lập luận của NVIDIA là biên giới thị trường CPU trong tương lai có thể không còn giới hạn ở máy chủ doanh nghiệp truyền thống, mà sẽ mở rộng sang các nhiệm vụ xử lý AI, tác nhân AI, học tăng cường, xử lý dữ liệu và các nhiệm vụ điều khiển, sắp xếp cơ sở hạ tầng AI.

Đây cũng là lý do NVIDIA cố gắng tái định nghĩa các quy tắc cạnh tranh của CPU.

Không cạnh tranh về số lượng lõi, NVIDIA đặt cược vào “tốc độ mỗi lõi”

Con đường thiết kế của Vera khác biệt rõ rệt so với CPU máy chủ truyền thống.

NVIDIA cho biết Vera là CPU đầu tiên của họ được thiết kế đặc biệt cho AI đại lý, sử dụng 88 lõi Olympus do NVIDIA tự thiết kế và có băng thông bộ nhớ 1,2 TB/s. Trước đó, NVIDIA cho biết Vera mang lại mức tăng hiệu năng đơn lõi lên đến 50% so với CPU truyền thống; trong các bài kiểm tra được công bố vào cuối tháng 5, Vera đạt tốc độ hoàn thành nhiệm vụ cụ thể nhanh gấp 1,8 lần so với CPU x86.

Trong bản tiết lộ mới nhất, NVIDIA đã nhấn mạnh thêm về định hướng thiết kế cốt lõi của Vera: thay vì chỉ đơn thuần tăng số lượng lõi, Vera chú trọng hơn vào hiệu năng luồng đơn, băng thông truyền thông giữa các lõi và độ trễ truy cập bộ nhớ.

NVIDIA cho biết, lõi Olympus tùy chỉnh của Vera mang lại hiệu năng luồng đơn tăng gấp đôi, băng thông giữa các lõi tăng gấp ba và giảm 40% độ trễ bộ nhớ so với thiết kế chiplet cạnh tranh. Mục tiêu của nó là giúp các đại lý AI hoàn thành nhiệm vụ nhanh hơn và trả lại tài nguyên tính toán cho GPU càng sớm càng tốt, từ đó nâng cao hiệu suất sử dụng của toàn bộ nhà máy AI.

Logic kinh doanh đằng sau điều này rất trực tiếp: GPU là một trong những tài nguyên tính toán đắt nhất và khan hiếm nhất trong trung tâm dữ liệu AI. Nếu CPU xử lý nhiệm vụ quá chậm, GPU có thể ở trạng thái chờ. NVIDIA mong muốn tối ưu hóa CPU một cách chuyên biệt để giảm thời gian “chạy không tải” này.

Trong các bài kiểm tra môi trường sản xuất do DeepInfra thực hiện trên Vera CPU, NVIDIA cho biết Vera có thể hỗ trợ tối đa 1,6 lần số lượng đại lý AI đồng thời và đạt tốc độ điều phối tác vụ cao nhất gấp 2,2 lần. Cần lưu ý rằng các dữ liệu này đến từ môi trường kiểm tra cụ thể của khách hàng và không có nghĩa là Vera dẫn đầu toàn diện trong mọi tải công việc CPU phổ biến.

Trọng tâm cạnh tranh đã được nâng cấp từ một con chip thành cả một “nhà máy AI”

Vera CPU chỉ là một phần trong chiến lược hệ thống lớn hơn của NVIDIA.

Trên nền tảng Vera Rubin, NVIDIA đã tích hợp CPU Vera, GPU Rubin, chip mạng Groq 3 LPX, Spectrum-6, SuperNIC ConnectX-9 và BlueField-4 vào một hệ thống được thiết kế đồng bộ.

NVIDIA cho biết, Vera Rubin NVL72 đang bước vào giai đoạn tăng sản lượng trên toàn cầu, và các đối tác như CoreWeave, Google Cloud, Microsoft Azure và Oracle Cloud Infrastructure đã bắt đầu triển khai các kệ liên quan. NVIDIA cũng cho biết chuỗi cung ứng của họ bao gồm hơn 350 nhà máy và 30 quốc gia, với hơn 300 đối tác tham gia.

Trong thử nghiệm khách hàng, CoreWeave sau khi chạy bài kiểm tra DeepSeek-R1 trên Vera Rubin NVL72 cho biết, số lượng Token được tạo ra mỗi giây mỗi megawatt đã tăng 10 lần so với thế hệ trước là Grace Blackwell NVL72. Google Cloud đã ra mắt các phiên bản A5X dựa trên Vera Rubin NVL72, với NVIDIA tuyên bố rằng trong các tình huống cụ thể, chúng có thể đạt chi phí suy luận thấp hơn và lưu lượng Token mỗi megawatt cao hơn.

Điều này có nghĩa là đối thủ cạnh tranh của NVIDIA giờ đây không còn chỉ là các chip tăng tốc đơn lẻ như Instinct GPU của AMD hay Gaudi của Intel.

NVIDIA đang cố gắng kiểm soát toàn bộ cơ sở hạ tầng: CPU chịu trách nhiệm lập lịch, GPU chịu trách nhiệm tính toán, chip mạng chịu trách nhiệm kết nối tốc độ cao, phần mềm chịu trách nhiệm lập lịch và tối ưu hóa, cuối cùng cung cấp hệ thống ở cấp độ kệ hoặc trung tâm dữ liệu cho khách hàng.

Đối với AMD và Intel, mối đe dọa từ cách cạnh tranh này là NVIDIA có thể không cần phải cạnh tranh trực tiếp và đối xứng với họ trên thị trường CPU truyền thống. Mục tiêu của NVIDIA là bắt đầu từ phân khúc có tiềm năng tăng trưởng cao nhất trong máy chủ AI, trước tiên giành lấy các công việc như AI đại lý, học tăng cường và suy luận AI hiệu năng cao, sau đó dần mở rộng phạm vi ứng dụng của CPU.

AMD và Intel đang đối mặt với những thách thức mới đối với lợi thế truyền thống của họ

Trong thời gian dài, Intel và AMD đã nắm giữ vị trí thống trị trên thị trường CPU máy chủ.

Tuy nhiên, hiện tại NVIDIA cho rằng cơ sở hạ tầng AI đang thay đổi thứ tự giá trị của CPU. Trước đây, cạnh tranh giữa các CPU máy chủ chủ yếu xoay quanh số lượng lõi, khả năng tính toán tổng quát và tổng lưu lượng; trong thời đại AI đại lý, tầm quan trọng của độ trễ thấp, hiệu suất đơn luồng, băng thông bộ nhớ và hiệu quả sắp xếp nhiệm vụ đang gia tăng.

Đây chính là khoảng trống thị trường mà NVIDIA tin rằng họ có thể khai thác.

Về mặt hình thái sản phẩm, Vera có thể được sử dụng như một CPU độc lập hoặc kết hợp với GPU của NVIDIA để tạo thành hệ thống Vera Rubin. NVIDIA còn định vị nó là thành phần then chốt kết nối các đại lý AI với tài nguyên tính toán GPU.

Trước đó, danh sách khách hàng mà NVIDIA công bố đã bao gồm các công ty AI như Anthropic, OpenAI và SpaceXAI, cùng với các nhà cung cấp dịch vụ đám mây như ByteDance, CoreWeave và Oracle Cloud Infrastructure; các nhà sản xuất máy chủ như Dell, Hewlett Packard Enterprise, Lenovo và AMD cũng đang thúc đẩy các hệ thống dựa trên Vera.

Điều này mang lại cho NVIDIA một lợi thế khác biệt so với các nhà sản xuất CPU truyền thống: nó có thể cung cấp cho khách hàng các giải pháp toàn diện thông qua sự kết hợp của GPU, CPU, mạng và phần mềm.

Tuy nhiên, điều này không có nghĩa là NVIDIA có thể dễ dàng lay chuyển AMD và Intel.

Cạnh tranh trên thị trường CPU không chỉ là cuộc đua về hiệu năng chip, mà còn bao gồm hệ sinh thái phần mềm, chứng nhận khách hàng, tương thích máy chủ và các mối quan hệ cung cấp dài hạn. Đặc biệt, các nhà cung cấp dịch vụ đám mây lớn và khách hàng doanh nghiệp thường cần nhiều năm để chuyển đổi nền tảng phần cứng.

Do đó, khả năng Vera thực sự mở rộng từ các kịch bản chuyên dụng AI sang thị trường máy chủ rộng lớn hơn vẫn phụ thuộc vào việc khách hàng có đạt được lợi thế rõ rệt về hiệu suất và chi phí hay không.

NVIDIA đang mở ra đường cong doanh thu mới ngoài GPU

Việc NVIDIA tập trung công bố thông tin về sản lượng và hiệu năng của Vera Rubin ngay trước sự kiện AI của AMD cũng mang ý nghĩa cạnh tranh thị trường rõ rệt.

Trong vài năm qua, NVIDIA gần như độc chiếm lợi nhuận cốt lõi nhất trong cơ sở hạ tầng AI nhờ vào GPU. Tuy nhiên, với việc AMD liên tục mở rộng bố trí bộ tăng tốc AI và Intel cũng đang tìm cách đột phá trên thị trường chip AI, thị trường ngày càng quan tâm đến việc NVIDIA có thể tiếp tục duy trì tăng trưởng mạnh mẽ hay không.

Trong khi đó, ngành kinh doanh CPU của AMD và Intel cũng được thị trường chú ý trở lại do kỳ vọng về nhu cầu mới từ AI dạng đại lý.

Phản ứng của NVIDIA là: nếu giá trị của trung tâm dữ liệu AI đang mở rộng từ tính toán đơn lẻ bằng GPU sang một nhà máy AI hoàn chỉnh, thì NVIDIA không cần phải nhường thị trường CPU cho đối thủ cạnh tranh.

From this perspective, Vera is not merely a server CPU launched by NVIDIA, but rather a further extension of its vertical integration strategy.

NVIDIA mong muốn khách hàng không còn mua từng GPU, CPU hoặc chip mạng riêng lẻ, mà là một hệ thống hạ tầng toàn diện có thể chạy trực tiếp các mô hình AI và đại lý AI.

Nếu AI kiểu đại lý thực sự trở thành động lực cốt lõi thúc đẩy sự tăng trưởng nhu cầu tính toán tiếp theo, thì NVIDIA có thể không chỉ cạnh tranh thị phần thị trường GPU, mà còn cả chuỗi giá trị tính toán máy chủ AI toàn diện.

Điều này cũng có nghĩa là, trong tương lai, AMD và Intel sẽ không chỉ đối mặt với nhau, mà còn phải đối mặt với NVIDIA – một công ty đã sở hữu khả năng về GPU, CPU, mạng, phần mềm và hệ thống máy tính hoàn chỉnh.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.