Nvidia membagikan model AI seperti sampel gratis di Costco. Logikanya juga sama: setelah Anda mencoba produknya, Anda akan kembali membeli perangkat keras yang paling cocok menjalankannya.
Rilisan terbaru perusahaan, Nemotron 3.5 Lightning, adalah model dengan 30 miliar parameter yang diluncurkan pada 11 Agustus 2026. Model ini menggunakan arsitektur Mixture of Experts (MoE) dengan sekitar 3 miliar parameter aktif, yang berarti dapat berjalan di satu GPU sambil mendukung jendela konteks hingga 1 juta token. Itu adalah jumlah kemampuan yang serius untuk model yang dapat Anda unduh dari Hugging Face tanpa membayar sepeser pun.
Pola pisau dan bilah, diperkuat
Nvidia kini menyediakan inferensi yang dihosting secara gratis untuk lebih dari 100 model AI melalui API build.nvidia.com. Pengembang dapat mengakses model-model ini tanpa perlu menggunakan kartu kredit, menguji nya dengan beban kerja mereka sendiri, dan membangun aplikasi berbasis model tersebut.
Pada awal 2026, Nvidia meluncurkan Nemotron 3 Ultra, raksasa dengan 550 miliar parameter, bersama Dynamo 1.0, perangkat lunak yang dikabarkan meningkatkan kinerja GPU hingga 7 kali lipat.
Mengapa model terbuka penting bagi bisnis GPU
Industri AI sebagian besar terpecah menjadi dua kubu. Di satu sisi, Anda memiliki perusahaan seperti OpenAI dan Anthropic yang membangun model tertutup dan propietaris di balik dinding pembayaran API. Di sisi lain, Anda memiliki Meta dengan seri Llama-nya dan sekarang Nvidia yang mendorong alternatif berbobot terbuka yang dapat diunduh, dimodifikasi, dan dideploy oleh siapa saja.
Model-model dirilis di bawah lisensi yang fleksibel, mencakup seluruh keluarga seperti Nemotron dan Cosmos. Model-model ini dioptimalkan untuk format perangkat keras khusus Nvidia seperti NVFP4, sebuah format kuantisasi yang dirancang untuk chip Nvidia.
Pada Agustus 2026, Nvidia juga memperkenalkan NeMo Switchyard, sebuah alat yang secara cerdas mengarahkan tugas ke berbagai model untuk mengurangi biaya inferensi.
