Nvidia, AI modellerini Costco'da ücretsiz örnekler gibi dağıtıyor. Mantık aynı: ürünü denediğinizde, onu en iyi şekilde çalıştıran donanımı almak için geri döneceksiniz.
Şirketin en son sürümü olan Nemotron 3.5 Lightning, 11 Ağustos 2026 tarihinde başlatılan 30 milyar parametreli bir modeldir. Yaklaşık 3 milyar aktif parametre ile Mixture of Experts (MoE) mimarisini kullanır ve 1 milyon token'a kadar bağlam penceresini desteklerken tek bir GPU üzerinde çalışabilir. Hugging Face'den ücretsiz olarak indirebileceğiniz bir model için bu, ciddi bir kapasite miktarıdır.
Bıçak ve bıçak sapı stratejisi, güçlendirildi
Nvidia, build.nvidia.com API'leri aracılığıyla artık 100'den fazla AI modeli için ücretsiz barındırılmış çıkarım hizmeti sunuyor. Geliştiriciler, kredi kartı kullanmadan bu modellere erişebilir, kendi iş yüklerine göre test edebilir ve bunların üzerine uygulamalar geliştirebilir.
2026'nın erken dönemlerinde, Nvidia, GPU performansını yaklaşık 7 kat artırabilecek olarak rapor edilen Dynamo 1.0 yazılımıyla birlikte 550 milyar parametrelik devasa Nemotron 3 Ultra'yı piyasaya sürdü.
Neden açık modeller GPU işi için önemlidir
Yapay zeka endüstrisi büyük ölçüde iki kampa ayrıldı. Bir tarafta, OpenAI ve Anthropic gibi şirketler API ücret duvarlarının arkasında kapalı, mülkiyetli modeller geliştiriyor. Diğer tarafta ise Meta, Llama serisiyle ve şimdi Nvidia, herkesin indirebileceği, değiştirebileceği ve dağıtabileceği açık ağırlıklı alternatifleri destekliyor.
Modeller, Nemotron ve Cosmos gibi tam aileleri kapsayan serbest lisanslar altında yayınlanmıştır. NVFP4 gibi Nvidia çipleri için tasarlanmış bir kuantizasyon formatı dahil olmak üzere Nvidia özel donanım formatları için optimize edilmiştir.
Ağustos 2026'da Nvidia, çıkarım maliyetlerini azaltmak için görevleri farklı modeller arasında akıllıca yönlendiren NeMo Switchyard adlı bir araç sundu.
