Nvidia 剛將一筆 200 億美元的授權協議轉化為實際運行的硬體。該公司確認,其 Groq 3 LPX 低延遲 AI 推理系統已進入全面生產階段,並將於今年年底前投入運營,這標誌著近期 AI 基礎設施史上最快的從協議到部署時間線之一。
該系統採用液冷設計,整合了 256 個語言處理單元,是英偉達於 2025 年聖誕前夕與推理晶片初創公司 Groq 簽訂的重磅授權協議的首款實體產品。Nebius 將透過其 Token Factory 平台率先部署此系統。
如何在八個月內將授權協議轉變為生產線
生產此硬體的這筆交易,在半導體產業標準下頗為特殊。英偉達並未直接收購 Groq,而是支付了 200 億美元,取得 Groq LPU(語言處理單元)設計的非獨家授權,有選擇地聘請了包括 Groq 創辦人兼執行長 Jonathan Ross 在內的關鍵人員,並讓 Groq 保持為一家獨立公司。Simon Edwards 現在領導 Groq,該公司在全球運營著 13 個數據中心。
Groq 3 LPX 位於 Nvidia 的 Vera Rubin 平台內,這是該公司更廣泛的下一代 AI 基礎設施堆棧。Nvidia 宣稱的效率數據令人矚目:每兆瓦的吞吐量最高可達傳統設置的 35 倍。
Groq 的融資動能與 Nvidia 的戰略定位
Groq 於 2026 年 6 月籌集了 6.5 億美元,隨後於 2026 年 8 月再籌集 3.5 億美元,使其估值達到 35 億美元。Nvidia 參與了 8 月的這輪融資,進一步加深了其與一家它已支付數十億美元授權費的公司的財務聯繫。
Groq 作為 Nvidia 雲端合作夥伴,可將 Nvidia 系統與其專有產品整合。
Nebius 與首個真實世界部署
選擇 Nebius 作為首個部署合作夥伴值得注意。該公司的 Token Factory 平台專為大規模推論工作負載設計,使其成為測試聲稱顯著提升推論效率的硬體的理想試驗場。
Nvidia 於 2026 年 8 月 24 日確認進入全面生產階段,部署計劃於年底前完成。
