نیوڈیا اپنے آنے والے روبن اولٹرا GPU میں ایک اہم سپیک تبدیلی پر غور کر رہی ہے، جس کے نتیجے میں چپ کو کمپنی کے اصلی ہدف کے مقابلے میں کافی کم ہائی بینڈ وِدتھ میموری کے ساتھ شپ کیا جا سکتا ہے۔ ٹرینڈ فورس کی جانب سے اگست 2026 کے شروع میں رپورٹ کیے گئے اس ایڈجسٹمنٹ کا مقصد تین بڑے پیداکاروں: ایس کے ہائِنِکس، سامسنگ اور مائیکرون سے HBM کی فراہمی میں تنگی کا جواب دینا ہے۔
روبن اولٹرا کے لیے اصل خیال طموحانہ تھا۔ جب نوڈیا نے 2025 میں اپنے جی ٹی سی ڈویلپر کانفرنس پر یہ چپ پیش کیا، تو ممکنہ کنفگریشنز میں 1 ٹی بی ہیم 4 ای میموری تک شamil تھی۔ موجودہ ویرا روبن جی پی یو، جو پہلے ہی بڑے پیمانے پر پیداوار میں ہے، 12-ہائی اسٹیکس میں تک 288 جی بی ہیم 4 کے ساتھ بھیجی جاتی ہے، جو تقریباً 22 ٹی بی/سیکنڈ کی میموری بینڈ وڈتھ فراہم کرتی ہے۔ روبن اولٹرا کو اس سے کئی گنا زیادہ آگے بڑھنا تھا۔
اب، نوڈیا کم از کم تین ورژنز کا امتحان کر رہی ہے جن میں میموری کو نمایاں طور پر کم کیا گیا ہے۔ ایک جائزہ کے تحت موجود کنفیگریشن 8-Hi HBM4 اسٹیکس استعمال کرتی ہے جو تقریباً 192 GB میموری فراہم کرتی ہے۔ موجودہ ویرا روبن پر 288 GB کے مقابلے میں، یہ ایک چپ پر 33 فیصد میموری کی کمی ہے جو ایک نسلی ترقی کا نمائندہ ہونا تھا۔
ای آئی ورک لوڈز کے لیے میموری کیوں ہر چیز ہے
ہائی بینڈ ویتھ میموری صرف صلاحیت کے بارے میں نہیں ہے۔ "بینڈ ویتھ" کا حصہ اس بات کو ظاہر کرتا ہے کہ میموری اور چپ کے پروسیسنگ کورز کے درمیان ڈیٹا کتنی تیزی سے منتقل ہوتا ہے۔ 22 ٹی بی/سی کے ساتھ، موجودہ ویرا روبن پہلے سے ہی اتنی تیز رفتاری سے کام کر رہا ہے کہ روایتی سرور میموری کو درجہ بدرجہ زبردست طور پر پیچھے چھوڑ دیتا ہے۔
12-Hi اسٹیکس سے 8-Hi اسٹیکس پر منتقلی سے صرف صلاحیت ہی نہیں، بلکہ ممکنہ طور پر بینڈ ویتھ بھی کم ہوتی ہے۔ نوڈیا کو رپورٹس کے مطابق، کمی کے باوجود چوٹی کی پرفارمنس کو برقرار رکھنے کے لیے مختلف ورژنز کا ٹیسٹ کر رہا ہے، لیکن کم تر میموری اسٹیکس کے فزکس نے انجینئرنگ آپٹیمائزیشنز کے ذریعے حاصل کی جانے والی بحالی پر اصل حدود عائد کر دی ہیں۔
ٹرینڈ فورس کی 4 اگست کی رپورٹ میں نوٹ کیا گیا کہ نوڈیا روبن اولٹرا کے لیے چار الگ HBM کنفیگریشنز کا جائزہ لے رہی ہے، جس میں 12-Hi HBM4E سے ہٹنے کا سبب 2027 تک گہرا ہونے کی توقع کی جانے والی DRAM اور HBM کی کمی ہے۔ تینوں بڑے HBM فراہم کنندگان پر ییلڈ اور پیداوار کے چیلنجز کی وجہ سے ایک ویفر تفویض کا بند راستہ پیدا ہو گیا ہے جسے نوڈیا اکیلے حل نہیں کر سکتی۔
کم کے ساتھ زیادہ کرنے کی پوشیدہ لاگت
اگر روبن اولٹرا میں ہر GPU کے لیے کم میموری ہو، تو بہت بڑے AI ماڈلز چلانے والے ادارے ایک جیسے ورک لوڈز کو سنبھالنے کے لیے زیادہ GPU کی ضرورت پڑ سکتی ہے۔ ایک ماڈل جو چار اعلیٰ میموری والے GPU پر فٹ ہو سکتا ہے، شاید چھ یا آٹھ کم میموری والے GPU کی ضرورت رکھتا ہو، جس سے مزید ہارڈویئر کے ساتھ اپنے اپنے اخراجات بھی آتے ہیں: زیادہ بجلی کا استعمال، زیادہ ریک جگہ، زیادہ انٹرکنیکٹ انفراسٹرکچر، اور زیادہ لائسنسنگ اوورہیڈ۔
نیوڈیا کی آمدنی کے منظر کے لیے بھی ایک نکتہ ہے۔ روبن اولٹرا کے لیے اصل میں منصوبہ بند کی گئی اعلیٰ خصوصیات والی میموری HBM4E، سپلائی چین کے تمام ارکان پر زیادہ مارجن فراہم کرتی ہے۔ کم درجے کی HBM کانفگریشنز کی طرف منتقلی سب سے منافع بخش میموری مصنوعات کی مانگ کو متاثر کرتی ہے، جس سے SK Hynix، سامسنگ اور مائیکرون کے پیداواری راستوں کو ترجیح دینے پر اثر پڑتا ہے۔
HBM کی فراہمی پہلے ہی اتنی محدود ہے کہ میموری کے manufacture کی جانب سے تفویض کے فیصلے حقیقی جغرافیائی سیاسی اور مقابلہ کی اہمیت رکھتے ہیں۔ Nvidia سب سے بڑا خریدار ہے، لیکن یہ AMD، Google، اور Amazon، Microsoft، اور Meta جیسے ہائپرسکیلرز کے بڑھتے ہوئے کسٹم AI چپ پروگرامز کے خلاف ویفر کی صلاحیت کے لیے مقابلہ کرتا ہے۔
ای آئی چپ مارکیٹ کے لیے اس کا کیا مطلب ہے
اہم HBM کے لیے DRAM ڈائس کا بہت دقیق طریقے سے تراشنا ضروری ہے، اور 12-Hi کنفیگریشنز کی پیداوار کی شرحیں سادہ 8-Hi اسٹیکس کے مقابلے میں کم ہوتی ہیں، جس سے ایسے پیداواری رکاوٹیں پیدا ہوتی ہیں جنہیں جلد حل نہیں کیا جا سکتا۔
اسی دوران، میموری فراہم کنندگان اپنے اپنے استراتیجک حسابات کا سامنا کر رہے ہیں۔ 2027 تک HBM کی محدود فراہمی قیمتوں کو بلند رکھتی ہے اور مانگ کو مضبوط رکھتی ہے، لیکن میموری میں کمی کے بدلے زیادہ GPU خریدنے پر مجبور کیے جانے والے صارفین کی وجہ سے فراہمی کے فرق کو بند کرنے کا دباؤ بڑھ رہا ہے۔ جو کمپنی پہلے 12-Hi یا 16-Hi اسٹیکنگ کا زیادہ سے زیادہ پیداواری طریقہ تلاش کر لے گی، وہ اگلے دور کے GPU ڈیزائن مذاکرات میں نمایاں لیوریج رکھے گی۔
