Nvidia memberikan model AI seperti sampel percuma di Costco. Logiknya juga sama: sekali anda mencuba produk tersebut, anda akan kembali membeli peranti keras yang paling sesuai untuk menjalankannya.
Rilisan terkini syarikat, Nemotron 3.5 Lightning, adalah model dengan 30 bilion parameter yang dilancarkan pada 11 Ogos 2026. Ia menggunakan arsitektur Mixture of Experts (MoE) dengan sekitar 3 bilion parameter aktif, bermakna ia boleh berjalan pada satu GPU sambil menyokong tetingkap konteks sehingga 1 juta token. Itu adalah jumlah kemampuan yang serius untuk model yang boleh anda muat turun dari Hugging Face tanpa membayar sepeser pun.
Rancangan pisau dan bilah, diperkuat
Nvidia kini menyediakan inferens yang dihoskan secara percuma untuk lebih daripada 100 model AI melalui API build.nvidia.com. Pembangun boleh mengakses model-model ini tanpa perlu menggunakan kad kredit, menguji mereka terhadap beban kerja sendiri, dan membina aplikasi berdasarkan model-model tersebut.
Pada awal 2026, Nvidia melancarkan Nemotron 3 Ultra, raksasa dengan 550 bilion parameter, bersama-sama dengan Dynamo 1.0, perisian yang dilaporkan meningkatkan prestasi GPU sehingga 7x.
Mengapa model terbuka penting untuk perniagaan GPU
Industri AI sebahagian besarnya terpecah kepada dua kumpulan. Di satu sisi, anda mempunyai syarikat-syarikat seperti OpenAI dan Anthropic yang membina model tertutup dan milik sendiri di sebalik dinding bayaran API. Di sisi lain, anda mempunyai Meta dengan siri Llama dan kini Nvidia yang mendorong alternatif berat terbuka yang boleh dimuat turun, diubah suai, dan dideploy oleh sesiapa sahaja.
Model-model dirilis di bawah lesen yang longgar, mencakup seluruh keluarga seperti Nemotron dan Cosmos. Model-model ini dioptimakan untuk format peranti keras khas Nvidia seperti NVFP4, satu format kuantisasi yang direka untuk cip Nvidia.
Pada Ogos 2026, Nvidia juga memperkenalkan NeMo Switchyard, sebuah alat yang secara pintar menghala tugas ke pelbagai model untuk mengurangkan kos inferens.
