NvidiaはCostcoで無料サンプルを配るようにAIモデルを提供しています。ロジックも同じです:製品を試せば、それを最も効果的に動かすハードウェアを買いに帰ってきます。
同社の最新リリースであるNemotron 3.5 Lightningは、2026年8月11日にリリースされた300億パラメータのモデルです。このモデルは、約30億のアクティブパラメータを用いたMixture of Experts(MoE)アーキテクチャを採用しており、1枚のGPU上で実行でき、最大100万トークンのコンテキストウィンドウをサポートします。Hugging Faceから無料でダウンロードできるモデルとして、これは非常に高い性能を備えています。
カミソリと替刃の戦略、パワーアップ版
Nvidiaは、build.nvidia.com APIを通じて、100以上のAIモデルに対して無料のホスト型推論を提供しています。開発者はクレジットカードを必要とせずにこれらのモデルにアクセスし、独自のワークロードでテストし、それらの上にアプリケーションを構築できます。
2026年初頭、Nvidiaは5500億パラメーターを備えるNemotron 3 Ultraと、GPUパフォーマンスを最大7倍に向上させるとされるDynamo 1.0ソフトウェアを発表しました。
GPUビジネスにとってオープンモデルが重要な理由
AI業界は大きく二つの陣営に分かれています。一方には、OpenAIやAnthropicのような企業がAPIの有料制限の裏で閉鎖的で独占的なモデルを構築しています。他方には、Metaが展開するLlamaシリーズや、今や誰でもダウンロード・修正・展開可能なオープンウェイトの代替モデルを推進するNvidiaがいます。
モデルは、NemotronやCosmosなどの全体のファミリーをカバーする許容的なライセンスでリリースされています。これらは、Nvidiaチップ用に設計されたNVFP4のようなNvidia固有のハードウェアフォーマットに最適化されています。
2026年8月、Nvidiaは、推論コストを削減するためにタスクを複数のモデル間で適切にルーティングするツール「NeMo Switchyard」を導入しました。
