動察 Beating の監測によると、NVIDIAはオープンソースモデル「Nemotron 3.5 Lightning」をリリースし、長時間実行されるAgentの「実行タスク」に特化させた。モデルの総パラメータ数は300億で、各トークンごとに30億のみが活性化され、ツール呼び出し、結果チェック、サブAgentのスケジューリングなどの高頻度タスクを主に担当する。NVIDIAの戦略は、Agentの役割分担をより徹底的に実現することである。複雑な計画はNemotron 3 Ultraなどの大規模モデルに任せ、大量の繰り返し実行はLightningに委ねる。公式によると、出力速度は同クラスのモデルと比較して最大4倍に達する。PinchBenchでは、Lightningの精度は86%に達し、精度がほぼ同等の条件下で、1万件のタスクを完了するのにQwen3.6 35Bより30%速い。 このモデルはMoEアーキテクチャを採用し、Agent Harness用に特別にトレーニングされ、複数トークン予測と推測デコードを導入している。公式ではBF16およびNVFP4の重みを提供しており、RTX 5090やDGX Sparkなどのローカルデバイスで実行可能であり、llama.cpp、Ollama、LM Studio、Unslothもサポートしている。 また、カスタマイズ性にも重点を置いている。NVIDIAは重み、一部のトレーニングデータ、トレーニング手順を公開しており、企業はコード、セキュリティ、法律などのタスクに対して追加のファインチューニングを実施できる。公式が提示した事例では、Lightningをファインチューニングした結果、複数の専門タスクで明確なスコア向上が確認された。
NVIDIA、エージェントツール実行用にNemotron 3.5 Lightningをオープンソース化
MarsBit共有
NVIDIAが、オンチェーンニュース環境におけるエージェントツール実行に最適化されたオープンソースのNemotron 3.5 Lightningをリリース。このモデルは1トークンあたり300億のアクティブパラメータを備え、類似モデルと比較して4倍の高速処理を実現。PinchBenchで86%の精度を達成し、Qwen3.6 35Bと比較して10,000タスクを30%高速に完了。MoEアーキテクチャを採用し、複数のプラットフォームをサポート。トレーニング用にオープンな重みを提供。新規トークン上場は、その速度とカスタマイズ性の恩恵を受ける可能性がある。
出典:原文を表示
免責事項: 本ページの情報はサードパーティからのものであり、必ずしもKuCoinの見解や意見を反映しているわけではありません。この内容は一般的な情報提供のみを目的として提供されており、いかなる種類の表明や保証もなく、金融または投資助言として解釈されるものでもありません。KuCoinは誤記や脱落、またはこの情報の使用に起因するいかなる結果に対しても責任を負いません。
デジタル資産への投資にはリスクが伴います。商品のリスクとリスク許容度をご自身の財務状況に基づいて慎重に評価してください。詳しくは利用規約およびリスク開示を参照してください。