Nvidia 發布免費的 300 億參數 AI 模型以促進 GPU 銷售

iconCryptoBriefing
分享
AI summary icon精華摘要
Nvidia 於 2026 年 8 月 11 日發布了擁有 300 億參數的 AI 模型 Nemotron 3.5 Lightning。該模型採用 MoE 架構,並針對單 GPU 性能進行優化,支援 100 萬個 token,並可於 Hugging Face 免費下載。公司還透過 build.nvidia.com API 提供超過 100 個模型的免費託管推理服務。這則 AI + 加密貨幣新聞突顯了 Nvidia 推動 GPU 需求的決心。鏈上新聞顯示,市場對 AI 驅動的區塊鏈工具興趣日益增長,開發者現在可無需預付成本即可測試模型。

Nvidia 正像在 Costco 免費派發樣品一樣分發 AI 模型。其邏輯也相同:一旦你試用了產品,你就會回來購買最適合運行它的硬體。

該公司最新發布的 Nemotron 3.5 Lightning 是一款擁有 300 億參數的模型,於 2026 年 8 月 11 日推出。它採用專家混合(MoE)架構,約有 30 億個激活參數,意味著它可以在單一 GPU 上運行,並支援長達 100 萬個 token 的上下文窗口。對於一款你可以從 Hugging Face 免費下載的模型來說,這是一種強大的能力。

廣告

剃刀與刀片策略,全面強化

Nvidia 現已透過其 build.nvidia.com API 為超過 100 個 AI 模型提供免費的託管推論。開發人員無需使用信用卡即可存取這些模型,測試其與自身工作負載的相容性,並基於這些模型構建應用程式。

2026 年初,Nvidia 推出了擁有 5500 億參數的巨無霸模型 Nemotron 3 Ultra,以及據稱可將 GPU 性能提升高達 7 倍的軟體 Dynamo 1.0。

為何開放模型對 GPU 業務至關重要

人工智能產業已大致分裂為兩個陣營。一方面,有像 OpenAI 和 Anthropic 這樣的公司,在 API 收費牆後面開發封閉的專有模型;另一方面,則有 Meta 推出的 Llama 系列,以及現在 Nvidia 推出的開放權重替代方案,任何人都可以下載、修改和部署。

這些模型採用寬鬆的授權條款發布,涵蓋整個系列,例如 Nemotron 和 Cosmos。它們針對 Nvidia 專用硬體格式(如 NVFP4)進行優化,這是一種為 Nvidia 芯片設計的量化格式。

在 2026 年 8 月,Nvidia 也推出了 NeMo Switchyard,這是一種能智能地將任務路由至不同模型以降低推論成本的工具。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露