Ngay trước buổi ra mắt sản phẩm hàng năm của AMD, NVIDIA đã công bố chi tiết hiệu năng thực tế của nền tảng Vera Rubin mới và chính thức công bố đầy đủ thông số kỹ thuật của chip CPU tự phát triển Vera. Chip Vera mang lại hiệu suất tăng gần gấp đôi so với chip x86 trong các tác vụ AI đại diện, đồng thời giảm độ trễ tới 6 lần. Khi chạy mô hình DeepSeek R1, nền tảng Vera Rubin NVL72 tăng 10 lần lượng token thông qua trên mỗi megawatt công suất so với thế hệ trước là GB200 NVL72. OpenAI, Anthropic và SpaceX đã nhận được lô giao hàng đầu tiên. Là chip CPU máy chủ đầu tiên do NVIDIA tự thiết kế, Vera có công suất từ 250-450 watt, hỗ trợ bộ nhớ lên đến 1,5 TB, dự kiến sẽ giao hàng 1,3 triệu con trong năm nay. Điều này đánh dấu sự gia nhập chính thức của NVIDIA vào thị trường CPU máy chủ, trực tiếp thách thức AMD và Intel. Thị trường CPU máy chủ do AI đại diện thúc đẩy có tiềm năng đạt quy mô 200 tỷ USD.Tác giả bài viết, nguồn: Wall Street Journal
Ngay trước thềm sự kiện ra mắt sản phẩm hàng năm của đối thủ cạnh tranh AMD, NVIDIA đã tung ra một đòn mạnh khi công bố chi tiết hiệu năng thực tế của nền tảng Vera Rubin mới và chính thức công bố đầy đủ thông số kỹ thuật của chip CPU tự phát triển Vera.
Vào thứ Ba, NVIDIA tiết lộ rằng Vera CPU có hiệu suất cao gần gấp đôi so với các chip x86 trong các tác vụ AI dạng đại lý, đồng thời giảm độ trễ tới sáu lần. Đồng thời, các bài kiểm tra sản xuất ban đầu từ đối tác điện toán đám mây CoreWeave cho thấy nền tảng Vera Rubin NVL72 khi chạy mô hình DeepSeek R1, đã tăng 10 lần lượng token thông qua trên mỗi megawatt công suất so với hệ thống GB200 NVL72 thế hệ trước dựa trên kiến trúc Blackwell.
Thời điểm công bố dữ liệu trên mang ý nghĩa sâu sắc. AMD sẽ tổ chức sự kiện ra mắt sản phẩm hàng năm "Advancing AI" tại San Francisco vào thứ Năm tuần này, và việc NVIDIA tập trung công bố dữ liệu hiệu năng vào thời điểm này bị các bên ngoài hiểu là một nỗ lực chủ ý nhằm tạo đà thị trường. Đối với các nhà cung cấp dịch vụ đám mây và khách hàng doanh nghiệp đang đánh giá đầu tư vào cơ sở hạ tầng AI thế hệ tiếp theo, bộ dữ liệu này sẽ ảnh hưởng trực tiếp đến quyết định mua sắm của họ.
Đồng thời, NVIDIA cũng chính thức công bố rằng lô CPU Vera đầu tiên đã được giao vào tháng 6, với các khách hàng bao gồm OpenAI, Anthropic và SpaceX. Điều này đánh dấu sự mở rộng chính thức của NVIDIA vào thị trường CPU, trực tiếp thách thức vị thế truyền thống của AMD và Intel.
Vera CPU ra mắt: NVIDIA chính thức gia nhập thị trường CPU máy chủ. NVIDIA đã công bố đầy đủ thông số kỹ thuật, kết quả kiểm tra hiệu năng và thông tin kiến trúc của sản phẩm CPU dữ liệu trung tâm Vera vào thứ Ba, đây là những dữ liệu thiết yếu để khách hàng tiềm năng đánh giá toàn diện chip này. Công ty cho biết, chip Vera đã được giao cho các khách hàng như OpenAI, Anthropic và SpaceX vào tháng 6.
Vera là CPU máy chủ đầu tiên của NVIDIA được thiết kế tự chủ từ cấp độ lõi, sử dụng kiến trúc vi lệnh tùy chỉnh có mã là "Olympus core", thay vì sử dụng các thiết kế sẵn có từ Arm.
Hannah Coutand, Trưởng nhóm thị trường sản phẩm Vera của NVIDIA, cho biết thiết kế của chip này tập trung vào tốc độ lõi đơn, băng thông bộ nhớ cao và độ trễ thấp, với mục tiêu "giúp các đại lý trả về GPU càng nhanh càng tốt và duy trì trạng thái sử dụng cao liên tục cho GPU". Về mặt thông số kỹ thuật phần cứng, công suất tiêu thụ của Vera nằm trong khoảng 250 watt đến 450 watt, với mỗi chip hỗ trợ tối đa 1,5 TB bộ nhớ tiết kiệm năng lượng.
Trong bài kiểm tra hiệu năng mới nhất, NVIDIA đã cho thấy Vera đạt hiệu suất cao hơn 1,9 lần so với chip x86 trong các tác vụ AI đại lý, đồng thời giảm độ trễ tới 6 lần. NVIDIA cũng cho biết, Vera vượt trội gần 100% so với CPU EPYC Turin hàng đầu của AMD trong một số bài kiểm tra hiệu năng tiêu chuẩn ngành. Trước đó, NVIDIA cũng tuyên bố Vera có hiệu suất tổng thể cao hơn 50% so với chip x86 trong các tác vụ AI đại lý.
Việc ra mắt Vera là bước mới nhất trong chiến lược tích hợp dọc của NVIDIA. Wolfe Research ước tính, giá trung bình mỗi con chip Vera vào khoảng 5.000 USD, với dự kiến sản lượng giao hàng trong năm nay khoảng 1,3 triệu con. Ian Buck, Phó chủ tịch tính toán quy mô lớn của NVIDIA, cho biết AI đại lý làm cho CPU trở nên “càng trở nên không thể thiếu hơn” và dự đoán quy mô thị trường tổng thể của CPU máy chủ cuối cùng có thể đạt 200 tỷ USD.
Thực nghiệm Vera Rubin: Tăng hiệu suất lên 10 lần CoreWeave đã hoàn thành việc triển khai và xác minh Vera Rubin NVL72 đầu tiên trong ngành vào đầu tháng 6 năm nay, bao gồm xác nhận toàn bộ hệ thống về điện năng, làm mát, mạng và tính toán. Dữ liệu được công bố lần này là kết quả thực nghiệm công khai đầu tiên về hiệu năng của chip Vera Rubin NVL72.
Kiểm tra dựa trên mô hình DeepSeek R1, trong cùng mục tiêu phản hồi tương tác, Vera Rubin NVL72 tạo ra số token mỗi megawatt mỗi giây đạt 10 lần so với GB200 NVL72. CoreWeave đồng thời chỉ ra rằng các tối ưu hóa thực hiện cho Vera Rubin cũng có thể được áp dụng ngược lại cho hệ thống GB200 NVL72, giúp tăng hơn bốn lần lượng đầu ra mỗi megawatt trong vòng ba tháng. NVIDIA cho biết các kết quả trên đã được xác minh thông qua hơn 250.000 cấu hình độc lập và hơn 1,4 triệu giờ GPU.
Ở cấp độ kiến trúc, tủ Vera Rubin NVL72 tích hợp 72 GPU Rubin và 36 CPU Vera, được kết nối thông qua kiến trúc NVLink 6 toàn diện với băng thông 260 TB/s và hỗ trợ native độ chính xác NVFP4. CoreWeave cho biết, sự cải thiện hiệu suất này có nghĩa là khách hàng có thể xử lý nhiều lưu lượng suy luận hơn trong cùng ngân sách công suất, hoặc chạy cùng một tải với ít điện năng hơn, từ đó giảm chi phí mỗi token.
CoreWeave cũng tiết lộ các ứng dụng cụ thể: một công ty an ninh mạng toàn cầu dự kiến chạy suy luận phát hiện mối đe dọa với hiệu suất mỗi watt tăng 10 lần; một công ty đại lý tự lập trình dự kiến mở rộng các nhiệm vụ đại lý với chi phí token giảm đáng kể; một công cụ tìm kiếm gốc AI dự kiến mở rộng dịch vụ tìm kiếm thời gian thực cho nhiều người dùng hơn mà không vượt quá giới hạn thời gian phản hồi.
Tối ưu hóa phối hợp hạ tầng: Tích hợp phần cứng và phần mềm giải phóng hiệu năng lớn hơn NVIDIA nhấn mạnh rằng việc nâng cao hiệu suất trên không chỉ dựa vào chip riêng lẻ, mà là kết quả tổng thể của chiến lược thiết kế phối hợp giữa phần cứng và phần mềm. Bằng cách tối ưu hóa động toàn bộ hạ tầng và chuỗi năng lượng, NVIDIA cho biết có thể triển khai nhiều GPU hơn 40% trong cùng phạm vi công suất.
Về làm mát, NVIDIA sử dụng hệ thống làm mát vòng kín ở 45°C, tiết kiệm khoảng 4 triệu gallon nước mỗi兆瓦 mỗi năm so với phương pháp làm mát tiêu chuẩn. Về mạng, kiến trúc kết nối NVLink thế hệ thứ sáu tăng 2,3 lần thông lượng giải mã mô hình ngôn ngữ lớn so với kiến trúc Ethernet; nền tảng Spectrum-X đạt băng thông Remote Direct Memory Access nhanh hơn 1,6 lần, đồng thời giảm 1,7 lần số lượng switch, tăng hiệu suất công suất quang lên năm lần và độ tin cậy tăng mười lần.
NVIDIA đã bắt đầu giao hàng nền tảng Spectrum-6 thế hệ mới nhất đến các khách hàng nhà máy AI như CoreWeave, Microsoft, Nebius B.V., SpaceXAI Corp. và Tesla. Hiện tại, NVIDIA đang tăng tốc giao hàng đến các khách hàng và đối tác như Google Cloud, Microsoft Azure, Meta, Oracle Cloud Infrastructure, Dell Technologies, OpenAI và CoreWeave.
NVIDIA vẫn là người thách thức trong lĩnh vực CPU, dù dữ liệu hiệu năng của Vera nổi bật, NVIDIA vẫn đối mặt với thách thức đáng kể về thị phần trong thị trường CPU. Chuyên gia phân tích của Gartner, Kevin Knox, cho biết AMD hiện là đối thủ chính trong lĩnh vực CPU máy chủ AI doanh nghiệp. Theo báo cáo, Intel chiếm khoảng 66,8% thị phần thị trường CPU máy chủ, AMD chiếm khoảng 33%, và AMD đang liên tục giành lấy thị phần đồng thời xây dựng mối quan hệ sâu sắc với các nhà cung cấp dịch vụ đám mây quy mô lớn.
Do kỳ vọng tăng cầu CPU được thúc đẩy bởi sự nổi lên của AI theo mô hình đại lý, cổ phiếu của AMD và Intel năm nay đã tăng lần lượt 128% và 149%, vượt xa mức tăng khoảng 8% của NVIDIA trong cùng kỳ, trở thành những cổ phiếu bán dẫn nổi bật nhất năm 2026.
Hiện tại, danh sách các đối tác nhà cung cấp dịch vụ đám mây chính của NVIDIA chỉ bao gồm Oracle, chưa bao gồm các nhà cung cấp đám mây chính khác. Hannah Coutand thừa nhận rằng Vera hiện vẫn đang ở "giai đoạn người dùng sớm", tuy nhiên OpenAI dự kiến bắt đầu triển khai quy mô lớn chip Vera sớm nhất trong quý này.
Karl Freund, người sáng lập Cambrian AI Research, tóm tắt ý định chiến lược của NVIDIA như sau: "Mục tiêu của họ là giúp khách hàng thoát khỏi sự phụ thuộc vào CPU của Intel hoặc AMD, và họ quyết tâm chiếm lĩnh phần doanh thu này. Họ chọn tập trung vào việc phát triển một CPU độc đáo mà hiện tại không ai trên thị trường cung cấp."
