IBM 已在 IBM Cloud 上推出 Nvidia 的 HGX B300 GPU 系統,讓受監管行業能透過受管理的雲端環境,使用市場上最強大的 AI 訓練硬體之一。這些系統於約 4 月 29 日上線,標誌著兩家公司擴大合作的最新一步,該合作最初於 2026 年 3 月的 GTC 大會上公布。
盒子裡面有什麼
每套 HGX B300 系統將八顆 Blackwell Ultra GPU 整合於單一節點中。其原始運算能力驚人:FP4 精度下最高達 144 PFLOPS,FP8 精度下達 72 PFLOPS。每套系統提供超過 2 TB 的共享 HBM3e 記憶體,這對於大型語言模型訓練至關重要,因為整個模型必須完全載入 GPU 記憶體,以避免因資料搬移而導致效能銳減。網路部分透過 Nvidia 的 ConnectX-8 適配器,以每顆 GPU 800 Gb/s 的速度運行,確保多節點訓練任務不會在互連層面出現瓶頸。
合規角度
HGX B300 的部署與 Red Hat OpenShift 和 IBM 的 watsonx 平台整合,打造出 IBM 所稱的完整受控 AI 工作流程堆疊。OpenShift 負責容器編排,讓工作負載可在於本地和雲端環境之間移動。watsonx 提供 AI 開發工具與治理層。兩者結合,使企業能在混合雲環境中訓練和部署模型,同時確保敏感資料停留在核准的範圍內。
時間與推出
初始可用性目標針對特定客戶和地區,預計將隨後擴大推廣。IBM 亦表示,HGX B300 系統的無伺服器叢集存取預計於 2026 年 5 月推出,這將讓客戶無需管理底層基礎設施即可使用 GPU 計算資源。
HGX B300 系統補充了 IBM Cloud 現有的 H200 實例,這些實例為無需 Blackwell Ultra 級硬體的工作負載提供較低性能的等級。
