Ang Nvidia ay nagbibigay ng AI models tulad ng libreng sample sa Costco. Parehong lohika: pagkatapos subukan ang produkto, babalik ka para bumili ng hardware na pinakamainam para dito.
Ang pinakabagong release ng kumpanya, ang Nemotron 3.5 Lightning, ay isang modelong may 30-bilyong parameter na ipinakilala noong Agosto 11, 2026. Gumagamit ito ng arkitekturang Mixture of Experts (MoE) na may halos 3-bilyong aktibong parameter, kaya ito ay maaaring mag-run sa isang solong GPU habang sumusuporta sa context windows na hanggang 1 milyong token. Ito ay isang seriyosong amount ng kakayahan para sa isang modelong maaari mong i-download mula sa Hugging Face nang walang bayad.
Ang razor-and-blades playbook, na pinapalakas
Nvidia ay nag-aalok ng libreng hosted inference para sa higit sa 100 na AI models sa pamamagitan ng mga API nito sa build.nvidia.com. Maaaring makapag-access ang mga developer sa mga model na ito nang walang paggamit ng credit card, subukan ang mga ito sa kanilang sariling workload, at bumuo ng mga aplikasyon dito.
Sa mga nakaraang bahagi ng 2026, inilabas ni Nvidia ang Nemotron 3 Ultra, isang behemoth na may 550-bilyong parameter, kasama ang Dynamo 1.0, isang software na batay sa ulat ay nagpapabuti sa performance ng GPU hanggang 7x.
Bakit mahalaga ang open models para sa negosyo ng GPU
Ang industriya ng AI ay malawakang nahati sa dalawang kamp. Sa isang panig, mayroon kang mga kumpanya tulad ng OpenAI at Anthropic na nagbuo ng saradong, propiyetaryong mga modelo sa likod ng mga pader sa pagbabayad ng API. Sa kabilang panig, mayroon kang Meta na may serye ng Llama at ngayon ay ang Nvidia na nagpapalabas ng mga alternatibong open-weight na maaaring i-download, baguhin, at i-deploy ng sinuman.
Ang mga modelo ay inilabas sa ilalim ng permissive licenses, na kumakapal ng buong mga pamilya tulad ng Nemotron at Cosmos. Sila ay dinisenyo para sa mga Nvidia-specific hardware formats tulad ng NVFP4, isang quantization format na disenyo para sa mga Nvidia chip.
Sa Agosto 2026, ipinakilala rin ni Nvidia ang NeMo Switchyard, isang kasangkapan na may-inteligensya upang magrout ng mga gawain sa iba’t ibang modelo upang bawasan ang mga gastos sa pag-infer.
