Nvidia 為解決 AI 數據中心內部的交通擁堵問題,推出了 Spectrum-X Ethernet 網絡架構,該架構結合了硬體加速的自適應路由、針對性擁塞控制和基於 NIC 的平面負載均衡,以確保數據在龐大的 GPU 網絡中高效流動。
聲稱的性能提升具有意義:Nvidia 表示,Spectrum-X 的網路吞吐量最高可達傳統乙太網解決方案的 1.6 倍。根據配置不同,任務完成指標提升 1.3 倍至 1.6 倍。
故障切換速度正是數字令人驚嘆之處。傳統基於以太網的系統在網路平面失效時,約需 1.08 秒才能恢復。Spectrum-X 則將此時間縮短至約 2.68 毫秒,降幅超過 99%。Nvidia 亦展示出,在八平面配置下,即使有一個平面失效,Spectrum-X 仍能維持約 90% 的頻寬持續性。
加倉與第五大支柱
在 2026 年 8 月的 Hot Chips 大會上,Nvidia 推出了其稱為 Scale-In 的功能,並將其定位為 AI 網絡的第五大支柱。Scale-In 使用 BlueField-4 數據處理單元搭配 DOCA 軟體來處理南北向流量,承擔安全、存儲和可觀察性工作負載,從而釋放主機 CPU 的處理週期。
Nvidia 在 Hot Chips 上公布的多層拓撲結構,可在雙層配置中擴展至超過 512,000 個端點,並具備朝向百萬 GPU 級叢集發展的路徑。針對這些超大規模部署的矽光子技術支援,目標於 2026 年下半年推出。層與層之間的效能隔離是核心設計原則,並在硬體層面強制執行。
為何這一點的重要性超越規格表
Vera Rubin 是 Nvidia 的平台,強調在大型 GPU 集群中的能效與韌性,位於 Nvidia 涵蓋晶片、網路、軟體和架構的全堆疊策略中心。
競爭格局包括 InfiniBand,Nvidia 透過其 Mellanox 收購也銷售此產品,並長期主導高效能運算網路。Spectrum-X 代表 Nvidia 對 AI 市場將標準化採用基於 Ethernet 的架構的押注。包括 Arista Networks 和 Broadcom 在內的競爭對手,在高速 Ethernet 交換市場中提供針對 AI 工作負載的功能,但均未銷售從 GPU 延伸至 NIC、DPU 及架構管理軟體的垂直整合堆疊。
