Nvidiaは、以前の6〜8ヶ月のペースから大幅に加速し、現在約1か月半ごとにオープンウェイトのAIモデルの新バージョンをリリースしています。同社の応用ディープラーニング研究担当バイスプレジデントであるブライアン・カタナザロは、2026年8月24日のインタビューでこの新しいスケジュールを明らかにしました。
何が加速を促しているのか
スピードアップは単なる野心ではありません。それはインフラです。Nvidiaは、合成データ生成、マルチティーチャー蒸留(MOPD)という技術、および強化学習環境に関する内部ツールを整備し、かつて数か月かかっていた開発作業を数週間以内に圧縮しました。
合成データ生成は、人間が手動で作成したデータセットに頼るのではなく、他のAIモデルが生成したデータを使ってAIモデルを学習させるプロセスです。マルチティーチャー蒸留は、複数の大型モデルから知識を抽出し、より小型で効率的なモデルに圧縮します。これらの技術を組み合わせることで、Nvidiaはリリースごとに大規模な新データセットを収集・クリーニングするボトルネックを回避しながら反復開発が可能になります。
このパイプラインの最新製品はNemotron 3.5 Lightningで、2026年8月11日にリリースされました。これは拡大するNemotron 3シリーズに加わるもので、既にNano、Super、Ultraのバリエーションを含み、それぞれ異なる使用ケースと計算予算をターゲットとしています。
2025年12月にリリースされたNanoモデルは、合計で約300億のパラメータを有していますが、特定のタイミングでは約30億のパラメータのみが活性化されます。これは、MambaとTransformerのアーキテクチャを混合エキスパート(MoE)構成で組み合わせたハイブリッド設計によるものです。SuperとUltraは2026年に続いたほか、チームはすでにNemotron 4の開発に着手しています。
オープンウェイト、オープンプレイブック
すべてのNemotronリリースには、許容的なライセンスのもとで、完全なオープンな重み、トレーニングレシピ、およびデータセットが含まれています。これにより、あらゆる開発者や企業は、Nvidiaにライセンス料を支払うことなく、これらのモデルをダウンロードし、変更し、デプロイできます。
モデルを無償提供することで、NVIDIAはそのモデルを動作させるためのハードウェアの需要を生み出しています。開発者がNemotron上で構築するほど、効率的にすべてを実行するためにNVIDIAの推論最適化チップ、NeMoフレームワーク、NIMマイクロサービスプラットフォームが必要になります。
オープンウェイト戦略は、優れたオープンモデルをリリースする中国のAIラボや、OpenAIやAnthropicのようなクローズドモデルプロバイダーに対する競争上の武器としても機能する。
ハードウェアはまだ別のクロックで動作しています
4〜6週間のサイクルは、ソフトウェア、特にNvidiaのAIモデルにのみ適用されます。同社のハードウェア製品、Blackwellアーキテクチャおよび今後登場するVera Rubinプラットフォームは、依然として年間スケジュールでリリースされます。
これがAIの景観に意味するところ
Nvidiaは、Nemotronモデルがテキスト生成にとどまらず、行動を取ったり、ツールを使用したり、半自律的に動作したりするエージェント用途向けに最適化されていることを明確にしています。
