AMD 剛剛向 Nvidia 投下了一枚極其昂貴的挑戰書。在柏林舉行的 IFA 2026 上,這家晶片製造商推出了 Threadripper Halo Station,一款被稱為「個人超級電腦」的桌上型工作站,專為在本地硬體上運行龐大 AI 模型而設計。目標受眾:那些不願每次想對萬億參數模型進行推論時,都將資料發送到雲端供應商的開發者和小型團隊。
這台機器直接針對 NVIDIA 的 DGX Station,後者是高端 AI 工作站領域的現任霸主。AMD 高級副總裁 Jack Huynh 於 9 月 4 日推出該系統,並將其定位為由人工智慧推動的「全新計算時代」的開端。
內部運作原理
其核心配備了 96 核的 Threadripper Pro 9995WX CPU,這是 AMD 至今最強大的桌上型處理器。
在 GPU 一側,系統配備雙 Instinct MI350P 加速器,可擴展至四個單元,均採用液冷設計。這四個 GPU 共計提供高達 576 GB 的 HBM3E 記憶體。系統記憶體最高可達 2 TB 的 DDR5。
AMD 表示,此配置可在不依賴雲端基礎設施的情況下處理萬億參數的 AI 模型。這是一個重要的區別。運行如此規模的模型通常需要租用由 AWS、Google Cloud 或 Microsoft Azure 運營的數據中心內 GPU 集群的時間。
為何現在本地 AI 硬體至關重要
過去兩年,針對本地 AI 計算的推廣聲浪日益高漲,這是有充分理由的。基於雲端的 AI 推理帶來了三個持續的痛點:延遲、成本和數據主權。
延遲很直接。將資料發送到遠端伺服器並等待回應會增加時間,而這時間會在數百萬次查詢中累積。對於實時應用程式,例如進行連續決策的 AI 代理,這種往返延遲可能成為致命問題。
此外還有資料主權,這在金融、醫療和防禦等受監管行業中至關重要。將敏感資料保留在本地機器上,可消除一整類合規風險。
AMD 認為,足夠多的買家會關注這三個問題,從而使一台完全配置後價格很可能達到六位數的工作站物有所值。行業估計 Halo Station 的價格就在這一範圍內,但 AMD 尚未公佈官方定價。
Nvidia 的問題
Nvidia 的 DGX Station 自推出以來,幾乎壟斷了高端 AI 工作站類別。該公司多年的 CUDA 軟體生態系統,已被開發者廣泛使用,僅靠硬體規格難以跨越這道護城河。
AMD 一直大力投資其 ROCm 軟體堆疊,這是一個開源的 CUDA 替代方案,以讓開發者更容易將其 AI 工作負載移植到 AMD 硬體上。
從原始規格來看,AMD 提出了有說服力的主張。該公司聲稱,Halo Station 提供的系統記憶體高於 Nvidia 的競爭產品,這對於需要將整個大型模型保留在記憶體中而非頻繁交換資料的工作負載而言可能至關重要。
Halo Station 基於 AMD 早期的 AI 推動,推出 Ryzen AI Halo,這是一款為 AI 加速筆記型電腦和桌面電腦設計的消費級晶片。
市場影響與關注重點
預計於 2027 年推出,意味著投資者在近期不會看到收入影響。分析師將密切關注兩點:AMD 是否能按時交付系統,以及 ROCm 生態是否能成熟到足以讓多年來基於 CUDA 建構的開發者使用此硬體。
