نیوڈیا AI ماڈلز کو کاسکو پر مفت نمونوں کی طرح تقسیم کر رہی ہے۔ منطق بھی ایک جیسا ہے: جب آپ اس پروڈکٹ کو آزمائیں گے، تو آپ اس کے لیے بہترین ہارڈویئر خریدنے کے لیے واپس آئیں گے۔
کمپنی کا تازہ ترین اختراع، نیمٹرون 3.5 لائٹننگ، ایک 30 ارب پیرامیٹر ماڈل ہے جو 11 اگست، 2026 کو لانچ ہوا۔ یہ ایک مکسچر آف ایکسپرٹس (MoE) آرکیٹیکچر استعمال کرتا ہے جس میں تقریباً 3 ارب فعال پیرامیٹرز ہیں، جس کا مطلب ہے کہ یہ ایک واحد GPU پر چل سکتا ہے جبکہ 1 ملین ٹوکنز تک کے کانٹیکسٹ ونڈوز کو سپورٹ کرتا ہے۔ یہ ایک بہت بڑی صلاحیت ہے جو آپ Hugging Face سے مفت میں ڈاؤن لوڈ کر سکتے ہیں۔
رازور اور بلیڈ کا اسکیم، سپر چارجڈ
نیوڈیا اب اپنی build.nvidia.com API کے ذریعے 100 سے زیادہ AI ماڈلز کے لیے مفت ہوسٹڈ انفرنس فراہم کرتی ہے۔ ڈویلپرز ان ماڈلز تک اپنی کریڈٹ کارڈ کا استعمال کیے بغیر رسائی حاصل کر سکتے ہیں، انہیں اپنے اپنے ورک لوڈز کے خلاف ٹیسٹ کر سکتے ہیں، اور ان کے اوپر ایپلیکیشنز تعمیر کر سکتے ہیں۔
2026 کے شروع میں، نوڈیا نے نیمٹرون 3 اولٹرا، ایک 550 ارب پیرامیٹر والی بھاری چیز، اور ڈینمو 1.0، سافٹ ویئر کو جاری کیا، جو رپورٹس کے مطابق جی پی یو کی کارکردگی کو تکرار 7 گنا تک بڑھاتا ہے۔
GPU کے کاروبار کے لیے کیوں کھلے ماڈلز اہم ہیں
AI صنعت نے اب تک دو گروہوں میں تقسیم ہو گئی ہے۔ ایک طرف، آپ کو OpenAI اور Anthropic جیسی کمپنیاں ملتی ہیں جو API کے پیس والوں کے پیچھے بند، ملکی ماڈلز تیار کر رہی ہیں۔ دوسری طرف، Meta اپنی Llama سیریز کے ساتھ اور اب Nvidia جو کھلے وزن والے متبادل پیش کر رہے ہیں جنہیں کوئی بھی ڈاؤن لوڈ، تبدیل اور ڈپلوی کر سکتا ہے۔
ماڈلز کو اجازت ناموں کے تحت جاری کیا گیا ہے، جو نیمٹرون اور کاسموس جیسے پورے خاندانوں کو شامل کرتے ہیں۔ انہیں NVFP4 جیسے نیکوڈیا کے لیے ڈیزائن کردہ کوانتائزیشن فارمیٹ کے لیے آپٹیمائز کیا گیا ہے۔
اگست 2026 میں، نوڈیا نے نیمو سوچھارڈ بھی متعارف کرایا، جو مختلف ماڈلز کے درمیان کاموں کو ذکیانہ طریقے سے راؤٹ کرتا ہے تاکہ انفرنس لاگت کم ہو۔
