Nvidia 正像在 Costco 免費派發樣品一樣分發 AI 模型。其邏輯也相同:一旦你試用了產品,你就會回來購買最適合運行它的硬體。
該公司最新發布的 Nemotron 3.5 Lightning 是一款擁有 300 億參數的模型,於 2026 年 8 月 11 日推出。它採用專家混合(MoE)架構,約有 30 億個激活參數,意味著它可以在單一 GPU 上運行,並支援長達 100 萬個 token 的上下文窗口。對於一款你可以從 Hugging Face 免費下載的模型來說,這是一種強大的能力。
剃刀與刀片策略,全面強化
Nvidia 現已透過其 build.nvidia.com API 為超過 100 個 AI 模型提供免費的託管推論。開發人員無需使用信用卡即可存取這些模型,測試其與自身工作負載的相容性,並基於這些模型構建應用程式。
2026 年初,Nvidia 推出了擁有 5500 億參數的巨無霸模型 Nemotron 3 Ultra,以及據稱可將 GPU 性能提升高達 7 倍的軟體 Dynamo 1.0。
為何開放模型對 GPU 業務至關重要
人工智能產業已大致分裂為兩個陣營。一方面,有像 OpenAI 和 Anthropic 這樣的公司,在 API 收費牆後面開發封閉的專有模型;另一方面,則有 Meta 推出的 Llama 系列,以及現在 Nvidia 推出的開放權重替代方案,任何人都可以下載、修改和部署。
這些模型採用寬鬆的授權條款發布,涵蓋整個系列,例如 Nemotron 和 Cosmos。它們針對 Nvidia 專用硬體格式(如 NVFP4)進行優化,這是一種為 Nvidia 芯片設計的量化格式。
在 2026 年 8 月,Nvidia 也推出了 NeMo Switchyard,這是一種能智能地將任務路由至不同模型以降低推論成本的工具。
