NVIDIA 在 AMD 年度產品發佈會前夕密集披露新一代 Vera Rubin 平台的實測性能數據,並正式公開自研 CPU 芯片 Vera 的完整規格。Vera CPU 在代理式 AI 任務上的性能較 x86 芯片提升近一倍,延遲改善達 6 倍。Vera Rubin NVL72 平台運行 DeepSeek R1 模型時,每兆瓦算力產生的 token 吞吐量較上一代 GB200 NVL72 提升 10 倍。OpenAI、Anthropic 和 SpaceX 已收到首批交付。Vera 作為 NVIDIA 首顆自主設計的伺服器 CPU,功耗為 250–450 瓦,支援 1.5TB 記憶體,預計今年出貨 130 萬顆。這標誌著 NVIDIA 正式進軍伺服器 CPU 市場,對 AMD 和英特爾發起直接衝擊。代理式 AI 推動伺服器 CPU 市場規模有望達到 2000 億美元。文章作者、來源:华尔街见闻
NVIDIA 在勁敵 AMD 年度產品發佈會召開前夕,打出一記重拳,密集披露新一代 Vera Rubin 平台的實測性能數據,並正式公開自研 CPU 芯片 Vera 的完整規格。
週二,英偉達披露,Vera CPU 在代理式 AI 任務上的性能比 x86 芯片高出近一倍,延遲改善幅度達六倍。與此同時,雲計算合作夥伴 CoreWeave 的早期生產測試顯示,Vera Rubin NVL72 平台在運行 DeepSeek R1 模型時,每兆瓦算力產生的 token 吞吐量比上一代基於 Blackwell 架構的 GB200 NVL72 系統提升 10 倍。
上述數據的發布時機頗具深意。AMD 將於本周四在舊金山舉行年度產品發布會 "Advancing AI",英偉達此時集中釋放性能數據,被外界普遍解讀為一次有意為之的市場造勢。對於正在評估下一代 AI 基礎設施投資的雲廠商和企業客戶而言,這批數據將直接影響其採購決策。
Meanwhile, NVIDIA has officially announced that the Vera CPU has completed its first batch of deliveries in June, with clients including OpenAI, Anthropic, and SpaceX. This marks NVIDIA's official entry into the CPU market, directly challenging AMD and Intel's traditional domains.
Vera CPU 正式亮相:英偉達正式進軍伺服器 CPU 市場 英偉達週二公布了資料中心 CPU 產品 Vera 的完整規格、基準測試結果及架構資訊,這些是潛在客戶全面評估該晶片所必需的關鍵資料。該公司表示,Vera 晶片已於 6 月交付給 OpenAI、Anthropic 和 SpaceX 等客戶。
Vera 是 NVIDIA 首顆從核心層面自主設計的伺服器 CPU,採用代號為 "Olympus core" 的定制微架構,而非沿用 Arm 提供的現成設計方案。
英偉達 Vera 產品市場負責人 Hannah Coutand 表示,該晶片的設計重點在於單核速度、高記憶體頻寬和低延遲,目標是「讓代理盡快返回 GPU,並保持 GPU 始終處於高度利用狀態」。在硬體規格方面,Vera 的功耗介於 250 瓦至 450 瓦之間,每顆晶片最高支援 1.5TB 低功耗記憶體。
在最新公布的基準測試中,英偉達展示了 Vera 相較於 x86 芯片在代理式 AI 任務上實現 1.9 倍性能提升,延遲降低 6 倍。英偉達還表示,Vera 在部分行業標準基準測試中超越 AMD 旗艦 EPYC Turin CPU 近 100%。此前,英偉達亦稱 Vera 在 AI 代理任務的整體性能上較 x86 芯片高出 50%。
Vera 的推出是英偉達垂直整合戰略的最新一步。Wolfe Research 評估,Vera 芯片的單顆平均售價約為 5000 美元,預計今年出貨量約達 130 萬顆。英偉達超大規模計算副總裁 Ian Buck 表示,代理式 AI 使 CPU 變得「更加不可或缺」,並預測伺服器 CPU 整體市場規模最終可能達到 2000 億美元。
Vera Rubin 實測:10 倍能效躍升 CoreWeave 於今年 6 月初完成了業界首次 Vera Rubin NVL72 的部署與驗證,涵蓋電力、冷卻、網絡和計算的全棧確認。此次披露的數據,是 Vera Rubin NVL72 硅片性能的首次公開實測結果。
以 DeepSeek R1 模型為基準,在相同互動響應目標下,Vera Rubin NVL72 每兆瓦每秒生成的 token 數量達到 GB200 NVL72 的 10 倍。CoreWeave 同時指出,針對 Vera Rubin 所做的優化亦可回溯應用於 GB200 NVL72 系統,使後者在三個月內每兆瓦吞吐量提升逾四倍。英偉達表示,上述成果經過超過 25 萬種獨立配置、逾 140 萬 GPU 小時的測試驗證。
從架構層面來看,Vera Rubin NVL72 機架整合了 72 顆 Rubin GPU 與 36 顆 Vera CPU,透過 260 TB/s 全互聯 NVLink 6 架構連接,並原生支援 NVFP4 精度。CoreWeave 表示,此效率提升意味著客戶可在相同的功耗預算內處理更多推理流量,或以更少電力運行相同負載,從而降低每 token 成本。
CoreWeave 亦披露了具體應用場景:一家全球網絡安全公司預計以每瓦性能提升 10 倍的方式運行威脅檢測推理;一家自主編程代理公司預計以大幅降低的 token 成本擴展代理任務;一家 AI 原生搜索引擎則預計在不突破響應時間限制的前提下,向更多用戶擴展實時搜索服務。
基礎設施協同優化:軟硬體一體化釋放更大效能 英偉達強調,上述性能提升並非單純依賴晶片本身,而是硬體與軟體協同設計策略的綜合成果。透過對完整基礎設施和能源棧的動態優化,英偉達表示可在相同功耗範圍內部署多 40% 的 GPU。
在散熱方面,英偉達採用 45°C 閉環液冷系統,與標準散熱方式相比,每兆瓦每年可節省約 400 萬加侖水。在網絡層面,第六代 NVLink 6 互聯架構在大型語言模型模擬解碼吞吐量上比以太網架構高出 2.3 倍;Spectrum-X 平台則實現了 1.6 倍更快的遠程直接內存訪問頻寬,同時減少 1.7 倍的交換機數量,光功率效率提升五倍,可靠性提升十倍。
英偉達最新一代 Spectrum-6 平台已開始向 CoreWeave、微軟、Nebius B.V.、SpaceXAI Corp. 和 特斯拉 等 AI 工廠客戶交付。目前,英偉達正加速向 谷歌雲、微軟 Azure、Meta、Oracle 雲基礎設施、戴爾科技、OpenAI 和 CoreWeave 等客戶和合作夥伴發貨。
儘管 Vera 的性能數據引人注目,英偉達在 CPU 市場仍面臨顯著的市場份額挑戰。Gartner 分析師 Kevin Knox 表示,AMD 目前是企業級 AI 伺服器 CPU 領域的主要競爭對手。據報導,英特爾在伺服器 CPU 市場佔有約 66.8% 的份額,AMD 約為 33%,且 AMD 正持續搶佔市場份額,並與超大規模雲服務商建立了深厚合作關係。
受代理式AI興起帶動的CPU需求預期提振,AMD 和 英特爾 今年以來股價漲幅分別達到 128% 和 149%,遠超 英偉達 同期約 8% 的漲幅,成為 2026 年表現最亮眼的晶片股。
目前,英偉達的主要雲服務商合作夥伴名單中僅列出了 Oracle,尚未涵蓋其他主流雲廠商。Hannah Coutand 承認,Vera 目前仍處於「早期採用階段」,不過 OpenAI 計畫最早於本季度開始大規模部署 Vera 芯片。
Cambrian AI Research 創始人 Karl Freund 將英偉達的戰略意圖概括為:「他們的目的是讓客戶擺脫對英特爾或 AMD CPU 的依賴,而他們對這部分收入志在必得。他們選擇專注於打造一款目前市場上其他任何人都尚未提供的獨特 CPU。」
