نیوڈیا چاhti ہے کہ آپ کے گھر کے کمپیوٹر ایک ٹیم کی طرح کام کریں۔ کمپنی کا نیا ذاتی AI روتر، جسے PAIR کہا جاتا ہے، مفت اور اوپن سورس سافٹ ویئر ہے جو مقامی نیٹ ورک پر مطابقت رکھنے والے مشینز کو دریافت کرتا ہے، انہیں جوڑتا ہے، اور AI انفرنس کے کاموں کو متعدد GPU پر تقسیم کرنے کے لیے تیار کرتا ہے، بغیر کسی پرامپٹ کو کلاؤڈ پر بھیجے۔
اسے اپنے رہائشی کمرے کے لیے ایک لوڈ بالانسر کی طرح سمجھیں۔ ایک پی سی کے بجائے جو اکیلے بڑے زبان ماڈل کو چلانے کی کوشش کر رہا ہو، PAIR نیٹ ورک پر موجود ہر صلاحیت رکھنے والے ڈیوائس پر ورک لوڈ کو تقسیم کرتا ہے اور درخواستوں کو اس مشین کو رُٹ کرتا ہے جس کے پاس دستیاب ہیڈ روم ہو۔
PAIR کیا کرتا ہے
PAIR ایک فزیکل راؤٹر نہیں ہے۔ کوئی نیا ہارڈویئر درکار نہیں، کوئی دیوار میں لگانے کے لیے باکس نہیں۔
یہ ایک سافٹ ویئر ہے جو مقامی AI انفرنس کے لیے نیٹ ورک کی دریافت، ڈیوائس کو آرڈینیٹ کرنے اور ٹاسک کا تقسیم کرتا ہے۔ مطابقت رکھنے والے ٹولز میں Ollama اور LM Studio شamil ہیں، جو صارفین کے ہارڈ ویئر پر بڑے زبانی ماڈلز چلانے کے لیے زیادہ مقبول ایپلیکیشنز میں سے دو ہیں۔
ڈیوائس کی سپورٹ زیادہ تر Nvidia کے اپنے ایکو سسٹم کی طرف جاتی ہے، جس میں GeForce RTX 20 سیریز کارڈز اور اس سے نئے ڈیوائسز، RTX Pro GPUs، اور DGX Spark سسٹمز شامل ہیں۔ Apple کے M4 چپس یا اس سے نئے بھی مطابق ہیں۔
نیوڈیا کا DGX Spark مقامی انفرنس لائن اپ کا سب سے بڑا خزانہ ہے۔ جب DGX Spark چلنے والی مشینوں کو کلسٹر کیا جاتا ہے اور ماڈلز کو کوانتائز کیا جاتا ہے، تو یہ سسٹم 200 ارب پیرامیٹرز کے دائرے میں ماڈلز کو سنبھال سکتا ہے۔
RTX 5090 جیسی اعلیٰ درجہ کی صارفین کی کارڈز 24 سے 32 جیگا بائٹ VRAM کے ساتھ بھیجی جاتی ہیں۔ PAIR کا کام یہ ہے کہ اس ہارڈویئر کو صرف ایک ڈیسک ٹاپ پر نہیں، بلکہ پورے گھر کے نیٹ ورک میں مفید بنائے۔
بڑی تصویر: نوڈیا کا AI کو مقامی بنانے کی کوشش
PAIR، نوڈیا کی ایک وسیع تر حکمت عملی تبدیلی کا حصہ ہے جسے وہ موازنہ کر رہی ہے۔ کمپنی نے ایک ایسی پہل چلائی ہے جسے وہ AI Grid کہتی ہے، جس کا مقصد بادل مبنی AI کے ساتھ جڑے لیٹنسی اور اخراجات کو کم کرنا ہے، جس میں کمپوٹیشن کو صارف کے قریب رکھا جاتا ہے۔
نیوڈیا نے 25 اگست، 2026 کو پرپلیکٹیٹی کے ساتھ ایک شراکت بھی قائم کی، جس نے کمپنیوں کے مطابق پورٹیبل کمپیوٹر کا اطلاق کیا، جو نیوڈیا کے ہارڈویئر پر مڈ-ٹائر Qwen ماڈلز کو مقامی طور پر چلانے کے لیے ڈیزائن کیا گیا ہے۔ کم سے کم VRAM 24 GB سے شروع ہوتا ہے، جو RTX 5090 ٹائر کے مطابق ہے۔
جدید AI ایجینٹس صرف ایک درخواست جاری نہیں کرتے اور روک جاتے؛ وہ سلسلہ وار دہوں درجے کے ماڈل کالز، ٹول استعمالات اور استدلال کے مراحل کو جوڑ دیتے ہیں۔ لمبے سلسلوں میں کلاؤڈ لیٹنسی جلدی بڑھ جاتی ہے۔ PAIR کے ذریعہ منظم ایک مقامی GPU نیٹ ورک راؤنڈ ٹرپ ٹائمز کو کم رکھتا ہے اور اس طرح ایجینٹک ایپلیکیشنز کو ہوسٹڈ API پر بڑے پیمانے پر چلانے والے فی ٹوکن لاگتوں سے بچاتا ہے۔
اس کا مقابلہ کی منظر نامہ کے لیے کیا مطلب ہے
نیوڈیا PAIR کو مفت، اوپن سورس سافٹ ویئر کے طور پر جاری کرکے ایک حساب شدہ اقدام کر رہی ہے۔ یہ ٹول خود بخود کوئی ب без رآمد نہیں پیدا کرتا، لیکن صارفین کی نیوڈیا ہارڈویئر پر انحصار کو گہرا کرتا ہے۔ اگر آپ کا گھریلو AI نیٹ ورک PAIR اور RTX GPU پر مبنی ہے، تو آپ کے اگلے اپ گریڈ کے لیے کم سے کم مزاحمت والی راہ نیوڈیا کے ایکو سسٹم کے اندر ہی رہتی ہے۔
AMD اور Intel دونوں مقامی انفرنس کے لیے مقابلہ کرنے والی GPU لائنز فراہم کرتے ہیں، اور Ollama جیسے اوزار کا اوپن سورس ہونا اس بات کا مطلب ہے کہ کوئی بھی ورک فلو سے باہر نہیں ہے۔ لیکن Nvidia کا CUDA ایکو سسٹم اور اس کا اہم انفرنس فریم ورکس کے ساتھ گہرا اندرونی ادغام PAIR کو ایک ایسی مطابقت کی ڈیپتھ فراہم کرتا ہے جسے مقابلہ کرنے والے فریق اسے جلدی نہیں دہرا سکتے۔
برائے کلاؤڈ فراہم کنندگان، PAIR کی نمائندگی کرنے والی یہ رجحان دھیان سے دیکھا جانا چاہیے۔ ایمیزون ویب سروسز، گوگل کلاؤڈ اور مائیکروسافٹ آزاری تمام AI انفرنس API ٹریفک سے معنی خیز آمدنی حاصل کرتے ہیں۔ وہ ٹولز جو اس ورک لوڈ کو صارفین کے ہارڈویئر پر منتقل کرتے ہیں، ان کاروباروں کی آگے کی منصوبہ بندیوں میں شامل نمو کے فرضیات پر حملہ کرتے ہیں۔
