Menurut pemantauan Beating, NVIDIA meluncurkan model open-source Nemotron 3.5 Lightning yang dirancang khusus untuk menangani tugas eksekusi jangka panjang pada Agent. Model ini memiliki total 30 miliar parameter, dengan hanya 3 miliar parameter yang diaktifkan per token, dan secara utama bertanggung jawab atas tugas-tugas frekuensi tinggi seperti pemanggilan alat, pemeriksaan hasil, serta penjadwalan sub-Agent. Pendekatan NVIDIA adalah membagi peran Agent secara lebih mendalam: perencanaan kompleks diserahkan kepada model besar seperti Nemotron 3 Ultra, sementara eksekusi berulang dalam jumlah besar ditugaskan ke Lightning. Menurut pihak resmi, kecepatan outputnya dapat mencapai empat kali lipat dibanding model sekelas. Di PinchBench, akurasi Lightning mencapai 86%, dan dalam kondisi akurasi yang sebanding, ia menyelesaikan 10.000 tugas 30% lebih cepat daripada Qwen3.6 35B. Model ini menggunakan arsitektur MoE, dilatih khusus untuk Agent Harness, serta dilengkapi dengan prediksi multi-token dan speculative decoding. NVIDIA menyediakan bobot dalam format BF16 dan NVFP4 yang dapat dijalankan di perangkat lokal seperti RTX 5090 dan DGX Spark, serta mendukung llama.cpp, Ollama, LM Studio, dan Unsloth. Model ini juga menekankan kemampuan kustomisasi; NVIDIA membuka akses terhadap bobot, sebagian data pelatihan, dan resep pelatihan, memungkinkan perusahaan untuk melakukan fine-tuning lebih lanjut untuk tugas-tugas seperti kode, keamanan, dan hukum. Dalam contoh yang ditampilkan oleh pihak resmi, setelah fine-tuning, Lightning menunjukkan peningkatan signifikan dalam berbagai tugas profesional.
NVIDIA Membuka Sumber Nemotron 3.5 Lightning untuk Eksekusi Alat Agen
MarsBitBagikan
NVIDIA merilis Nemotron 3.5 Lightning sebagai sumber terbuka, dioptimalkan untuk eksekusi alat agen di lingkungan berita on-chain. Model ini memiliki 30 miliar parameter aktif per token dan berjalan empat kali lebih cepat daripada model serupa. Model ini mencapai akurasi 86% di PinchBench dan menyelesaikan 10.000 tugas 30% lebih cepat daripada Qwen3.6 35B. Dibangun dengan arsitektur MoE, model ini mendukung berbagai platform dan menyediakan bobot terbuka untuk pelatihan. Pencatatan token baru mungkin mendapat manfaat dari kecepatan dan opsi penyesuaianannya.
Sumber:Tampilkan versi asli
Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini.
Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.