مصنف: دونگ جنگ
ماخذ: 华尔街见闻
اپنی پہلی خود ساختہ چپ Jalapeño کے ساتھ OpenAI نے AI چپ کے شعبے کو ایک حیرت انگیز رفتار سے الٹ دیا — یہ صرف ایک مصنوعات کا اعلان نہیں بلکہ ایک اشارہ بھی ہے کہ AI اب چپس کے ڈیزائن کے طریقے کو دوبارہ ترتیب دے رہا ہے۔
华尔街见闻文章 کے مطابق، بلوومبرگ کی 25 اگست کی رپورٹ کے مطابق، OpenAI نے کہا ہے کہ Jalapeño، یونٹ فی توانائی پر AI کام کی مقدار اور جواب کی رفتار جیسے دو اہم اشاریوں میں NVIDIA GB300 سے آگے ہے۔ یہ چپ OpenAI اور Broadcom کے تعاون سے تیار کی گئی ہے، جو AI انفرنس مرحلہ کے لیے خاص طور پر ڈیزائن کی گئی ہے اور اسے اس سال کے آخر تک عملی استعمال میں لایا جا سکتا ہے۔ OpenAI کے چپ کے سربراہ Richard Ho نے کہا کہ Jalapeño صرف 700 واٹ کم طاقت کے ساتھ طاقتور پرفارمنس فراہم کرتا ہے، جس سے ڈیٹا سنٹر کی بجلی کی لاگت میں بڑی کمی آئے گی۔

سیمی اینالیسس کے مطابق، اس چپ کے ڈیزائن شروع ہونے سے لے کر اس کے فلو ہونے تک صرف تقریباً 16 ماہ لگے، جبکہ اہم CoWoS پیکیج فلو نوڈ 2025 کے نومبر میں مکمل ہوا، جو اب تک صرف 9 ماہ کا فاصلہ رکھتا ہے، جو صنعت کی عام 18 سے 36 ماہ کی مدت سے کہیں کم ہے۔

سیمی اینالیسس کے محققین نے OpenAI لیب میں جا کر اپنے خود ساختہ بینچ مارک سوٹ InferenceX کا استعمال کرتے ہوئے Jalapeño کا امتحان لیا، اور نتیجہ واضح ہوا: یہ چپ انہوں نے پہلے جو نیوڈیا، ایم ڈی اے اور گوگل کے چپس ٹیسٹ کیے تھے، ان سب پر فی واٹ پرفارمنس (perf/W) کے معیار پر غالب آ گئی۔
زیادہ اہم بات یہ ہے کہ یہ کامیابی Jalapeño کے طرف سے شارٹ کریکنگ، پری فل اور ڈیکوڈنگ کو الگ الگ ڈیپلومنٹ کے طور پر آپٹیمائز کرنے کے بغیر حاصل کی گئی ہے، جبکہ دیگر مقابلہ کرنے والے چپس پہلے ہی اپنے بہترین کنفیگریشنز کو فعال کر چکے ہیں۔
اس لیے کہ مشہور سیمی کنڈکٹر تجزیہ کار ڈائلن پیٹل بھی کہتے ہیں، "بلیکول کے ساتھ ساتھ نوڈیا روبن چپ بھی پیچھے رہ گئی ہے!"

تجزیہ کے مطابق، یہ نتیجہ نیوڈیا کی مارکیٹ کی حیثیت کو ب без تھا، اور مارکیٹ کو AI چپس کے مقابلے کے منظر نامے کو دوبارہ جانچنے پر مجبور کر دیا۔
تجربہ کیا گیا ڈیٹا: Jalapeño کئی اہم اشاریوں میں Blackwell کو دبا دیتا ہے
سیمی اینالیسس کے ٹیسٹ نتائج ظاہر کرتے ہیں کہ جلپیںو کو انفرینس کی کارکردگی میں کافی برتری حاصل ہے۔
GPT-OSS 120B ماڈل پر، Jalapeño فی سیکنڈ تقریباً 1459 ٹوکنز پیدا کرتا ہے، جبکہ نیوڈیا GB200 صرف 535 ٹوکنز؛ ایک مکمل عمل کے لیے، Jalapeño صرف 1.65 سیکنڈ لیتا ہے، جبکہ GB300 تقریباً 6 سیکنڈ لیتا ہے، جس کا فرق 3.6 گنا ہے۔ اعلیٰ تعامل کے مناظر میں، جب GB300 کو اپنی تیز ترین ڈیکوڈنگ رفتار (فی سیکنڈ 169 ٹوکنز) تک پہنچایا جاتا ہے، تو Jalapeño کی ٹھیکنگٹ کا 104.3 گنا ہوتا ہے۔

مرکزی ڈیٹا سینٹر کی کارکردگی کے اہم معیار، ہر میگاواٹ فی سیکنڈ پر ٹوکن کی تعداد پر، جالاپینو GPT-OSS ماڈل پر تقریباً 53 ملین ٹوکن/میگاواٹ/سیکنڈ حاصل کرتا ہے، جبکہ GB200 NVL72 صرف تقریباً 10 ملین ہے۔

سیمی اینالیسس کا کہنا ہے کہ یہ اشارہ بنیادی طور پر ہر جول کے لیے پیدا ہونے والے ٹوکن کی تعداد کے برابر ہے، جو ڈیٹا سینٹر کی آمدنی کی حد کو ب безا ترتیب دیتا ہے — جبکہ اب اسپیڈ کو بجلی کے پابندیوں سے محدود کیا گیا ہے، اس پہلو کا فائدہ خاص طور پر اہم ہے۔
سسٹم لیول کی لاگت کے لحاظ سے، سیمی اینالیسس کے مطابق، بجلی، ٹھنڈا کرنا اور نیٹ ورک کو شامل کرتے ہوئے، جلاپینیو کی ہر چپ کی گھنٹہ کی کل مالیت تقریباً 1.56 امریکی ڈالر ہے، جو H100 کے 1.55 امریکی ڈالر کے تقریباً برابر ہے، جبکہ نوڈیا ویرا روبن کی 3.61 امریکی ڈالر ہے۔

یہ قابل ذکر ہے کہ سیمی اینالیسس نے کئی اہم تحفظات بھی پیش کیے ہیں۔
اول یہ کہ جس ماڈل کا استعمال ٹیسٹ کے لیے کیا گیا، وہ حال کے سب سے جدید ماڈل نہیں ہے؛ نوڈیا اور ایم ڈی اے نے بڑے ماڈلز جیسے DeepSeek V4 Pro، Kimi K3 پر AgentX ٹولکٹ کے ذریعے نتائج جاری کر دیے ہیں، جبکہ Jalapeño ابھی تک AgentX ٹیسٹ مکمل نہیں کر چکا — یہ ٹولکٹ متعدد اور لمبے کنٹیکس جیسے حقیقی پیداواری مناظر کی کارکردگی کو زیادہ بہتر طریقے سے ظاہر کرتا ہے۔
دوم، ایک اور انصاف آمیز تقابل Blackwell کے بجائے HBM4 کا استعمال کرنے والی نیوڈیا ویرا روبن سے ہونا چاہیے؛ ویرا روبن کی فی واٹ کارکردگی GB200 NVL72 کے مقابلے میں تقریباً 5.4 گنا بڑھ جاتی ہے، اور جالاپینو کے ساتھ، دونوں کی فی ٹوکن کل مالیت (TCO) تقریباً ایک جیسی ہے۔
تیسری بات یہ ہے کہ جلاپینیو ابھی تک انجینئرنگ سیمپل مرحلے میں ہے، اور ماس پروڈکشن 2027 تک تدریجی طور پر شروع ہوگا۔
ای آئی ڈیزائن چپ: جی پی ٹی-اسٹرا اور کوڈیک کا "فلائی ویل ایفیکٹ"
جلاپینیو کے اتنی تیزی سے ترقی کا ایک مرکزی سبب AI ٹولز کی گہری مداخلت ہے۔ سیمی اینالسس کے مطابق، OpenAI نے چپ ڈیزائن کے عمل میں اپنے اندر کے AI ماڈلز، جن میں بیرونی دنیا کی طرف سے زبردست توجہ حاصل کرنے والا GPT-Astra بھی شامل ہے، کا زبردست استعمال کیا۔
سماجی میدان X کے صارف اینڈریو کرین نے OpenAI کی معلومات کا حوالہ دیتے ہوئے بتایا کہ GPT-Astra نے Jalapeño کے ترقی کے پورے دور میں گہری شراکت کی:
ٹیم نے Codex اور GPT-Astra کی مدد سے دو ماہ میں تین ایسے اوپن سورس ماڈلز کو جو جلپینو کے ماس پروڈکشن منصوبے میں شامل نہیں تھے، انہیں اعلیٰ کارکردگی کی حالت میں بہتر بنایا۔

اس کا مطلب یہ ہے کہ AI صرف چپ ڈیزائن کو تیز کرنے میں مدد کر رہا ہے، بلکہ چپ کے ذریعے سپورٹ کیے جانے والے ماڈلز کے دائرے کو بھی تیزی سے وسعت دے رہا ہے۔
سیمی اینالیسس کے ڈیٹا نے اس کے اس حصے کو مزید مقداری شکل دیا:
ای آئی کی مدد سے ڈیزائن کرنے سے SIMD یونٹ کا رقبہ 8% کم ہو گیا، میٹرکس انجن کا رقبہ 10% کم ہو گیا، جبکہ ٹائمنگ اور طاقت کے اداء میں بھی ابتدائی ورژن سے بہتر ہے۔

سافٹ ویئر کے لیول پر، OpenAI نے Jalapeño کرنل کو اپنے اندر کے وسیع کردہ Codex کا استعمال کرتے ہوئے لکھا ہے، جس کے کچھ کرنل کوڈ تقریباً 3000 لائنز تک ہیں؛ سب سے زیادہ پرفارمنس کی ضرورت والے توجہ میکانزم اور MoE ماڈیولز پر، AI کے ذریعہ تخلیق کردہ کوڈ انسانی عظیم انجینئرز کے عمل سے 1.5 سے 1.8 گنا تیز ہے۔
سیمی اینالیسس نے اس کا جائزہ بہت تیزی سے دیا: NVIDIA کے GPU پر چلنے والے OpenAI ماڈلز (جیسے GPT-5.6 Sol) کا استعمال ایک� ایسے چپ کی ڈیزائن کے لیے کیا جا رہا ہے جو CUDA کی دفاعی دیوار کو حقیقی خطرہ پیدا کرے گی — "NVIDIA کے اپنے GPU اپنے ممکنہ جانشین کو عملی شکل دے رہے ہیں"۔

آرکیٹیکچر کا تجزیہ: کیوں "جنرل پرپوز" زیادہ تیز ہے؟
بیرونی دنیا عام طور پر یہ فرض کرتی ہے کہ Jalapeño ایک ایسا چپ ہے جو OpenAI کے اپنے ماڈلز کے لیے گہرائی سے کسٹمائز کیا گیا ہے، لیکن SemiAnalysis کا نتیجہ بالکل اس کے برعکس ہے: Jalapeño AI انفرینس کے لیے ایک جنرل پرپوز چپ ہے جو مختلف ماڈلز اور ورک لوڈز، جن میں Codex کے ذریعے منتقل کیا گیا ڈائیو وار گیم بھی شامل ہے، چلا سکتی ہے۔
آرکیٹیکچرل سطح پر، جالاپینیو کا مرکزی ڈیزائن فلسفہ "فکسڈ لیٹنسی کو ختم کرنا" ہے۔ جبکہ GPU پیچیدہ میموری ہائرارکی پر منحصر ہوتی ہے، جالاپینیو کمپوٹیشنل کورز کو HBM ٹکڑوں کے ساتھ براہ راست جوڑتا ہے، اور کورز کے درمیان مخصوص اعلیٰ بینڈ ویتھ کالیکٹو نیٹ ورک کے ذریعے سنکرونائزیشن ہوتی ہے، جس سے میموری ایکسس لیٹنسی میں بڑا کمی آتا ہے۔
اس کے علاوہ، جلپینو ایک آؤ آؤ کور کے ساتھ ایل 1 کیش کا استعمال کرتا ہے، جو دیگر ایکسلریٹرز عام طور پر سافٹ ویئر مینیجڈ کیش کا استعمال کرتے ہیں، جس سے یہ چھوٹے بیچ اور کم لیٹنسی کے مناظر میں ہارڈ ویئر کے نظریہ پر مبنی پیک کے قریب تر پہنچتا ہے۔
میموری بینڈ ویڈت کے لحاظ سے، جلاپینیو HBM4 کا استعمال کرتا ہے جس سے ایک پیکیج میں 15.4 ٹیرا بائٹ فی سیکنڈ کی میموری بینڈ ویڈت حاصل ہوتی ہے، جبکہ فی واٹ HBM بینڈ ویڈت 22 ہے، جبکہ نیوڈیا روبن 11.1 اور GB300 صرف 5.71 ہے۔

سیمی اینالسیس کا کہنا ہے کہ Jalapeño کا HBM4 پن 10Gbps کی رفتار سے چل رہا ہے، جو نیکوڈیا Rubin کے 9.6Gbps سے تھوڑا زیادہ ہے، اور HBM فراہم کنندہ ممکنہ طور پر سامسنگ ہو سکتا ہے۔
یہ قابل ذکر ہے کہ Jalapeño نے پری-فِل اور ڈیکوڈنگ کے الگ الگ ڈیپلویمنٹ (PDD) کو نہیں اپنایا۔ SemiAnalysis نے اس کی تفصیلی وضاحت کی ہے:
حقیقی پیداواری ماحول میں، ان پٹ آؤٹ پٹ نسبت، کنکرنس لیول، کیش ہٹ ریٹ جیسے پیرامیٹرز مسلسل تبدیل ہوتے رہتے ہیں، جس سے ثابت پولنگ سے عالمی استعمال کم ہو جاتا ہے؛ جبکہ ہم جنس وسائل کے پول سے ٹریفک کی تبدیلیوں کے لیے لچکدار طور پر جواب دیا جا سکتا ہے اور تاخیر حساس درخواستوں اور اعلیٰ ٹھیکہ بیچ پروسیسنگ کے درمیان متحرک طور پر تقسیم کیا جا سکتا ہے۔
CUDA کا قلعہ: دراڑیں ظاہر ہو گئی ہیں؟
سیمی اینالیسس نے اپنی رپورٹ میں ایک اہم جائزہ پیش کیا ہے: CUDA کا دفاعی دیوار ممکنہ طور پر ختم ہو چکا ہے۔
اس کا بنیادی تقاضہ سافٹ ویئر کی شروعاتی رفتار کے موازنے پر ہے۔ نوڈیا کا روبن CoWoS چپ Jalapeño سے ایک ماہ پہلے مکمل ہو گیا، لیکن اب تک، روبن کے لیے صرف کور ویو کے انجینئرنگ نمونے سے عوامی بنچ مارک دستیاب ہیں، اور نوڈیا نے اوپن اے آئی کی طرح تیسری پارٹی کو اپنے لیب میں آزادانہ ٹیسٹنگ کی اجازت نہیں دی۔ سیمی اینالسز کا خیال ہے کہ یہ فرق صرف ہارڈ ویئر کا نہیں بلکہ سافٹ ویئر کی پختگی کا فرق ہے۔
صفر سے سافٹ ویئر اسٹیک بنانے سے OpenAI کو تاریخی بوجھ سے آزاد ہو کر زیادہ صاف تعمیری فیصلے کرنے کا موقع ملا۔ OpenAI نے اپنی خود ساختہ کرنل پروگرامنگ زبان Gluon (Triton پر مبنی) اور اندرونی انفرینس انجن "Teacup" کا استعمال کیا، اور Codex کی مدد سے کرنل کی تیزی کو جلدی حاصل کیا۔ SemiAnalysis نے مشاہدہ کیا کہ صرف دو ہفتے میں، Jalapeño نے مخصوص انٹرایکشن سپیڈ پر ٹھروٹل کو دو گنا سے زیادہ بڑھا دیا؛ 8 دن میں، ٹیم نے ٹینسر پیرلیلز کو TP8 سے TP32 تک وسعت دے دی اور پورے کینٹری سائز ڈپلوائمنٹ کو کراس-ریک کے ساتھ حاصل کر لیا۔
تاہم، SemiAnalysis نے واضح طور پر اشارہ کیا ہے کہ موجودہ ٹیسٹ صرف ایک نسبتاً آسان ورک لوڈ 8k1k تک محدود ہے، اور AgentX کے متعدد مرحلہ لمبے کنٹیکس ٹیسٹ ابھی مکمل نہیں ہوئے۔ زیادہ پیچیدہ ایجنٹ ورک لوڈز پر، روتر، پریفکس کیش اور دیگر کمپوننٹس کی کارکردگی نئی چیلنج بن جائے گی۔
اگلا قدم: B0 فیکٹری میں داخل ہو چکا ہے، 10 گیگاواٹ کا منصوبہ آہستہ آہستہ شروع ہو رہا ہے
جالاپینو کی کہانی ابھی ختم نہیں ہوئی۔
سیمی اینالیسس کے مطابق، موجودہ پبلک ٹیسٹ میں صرف A0 سٹیپ ڈیموں کا استعمال ہو رہا ہے، جبکہ B0 سٹیپ فیکٹری میں ہے اور اس کی فی واط پرفارمنس A0 کے مقابلے میں تقریباً 25% بہتر ہونے کا تصور ہے — B0 کا ایک چپ کمپیوٹنگ ڈائے MXFP4 کی صلاحیت 13.4 PFLOPs ہوگی، جبکہ TDP 700W پر برقرار رکھا جائے گا۔
سسٹم کے لیول پر، OpenAI نے Celestica کے ساتھ مل کر مکمل ریک ڈیزائن کیا ہے: ہر ASIC کیبنٹ میں 128 Jalapeño چپس ہیں، اور دو کیبنٹس کے سسٹم کی کل طاقت تقریباً 160kW ہے، جو نوڈیا GB300 دو چوڑے کیبنٹس کے برابر ہے۔

اسکیلنگ کے حوالے سے، ایک منفرد اسکیل نیٹ ورک ڈومین میں زیادہ سے زیادہ 2048 Jalapeño XPU جوڑے جا سکتے ہیں، جو 16 ریکس تک کور کرتا ہے۔ مصنوعات کی بڑے پیمانے پر تیاری کے حوالے سے، SemiAnalysis کا تخمینہ ہے کہ 2027 تک یہ ترقی کا عمل شروع ہوگا، اور اگلا اہم مقصد 100MW کا اسکیل ڈپلویمنٹ ہے۔
بڑی حکمت عملی کے نقشے میں، اوپن اے آئی نے بروڈکام کے ساتھ 10GW کسٹم ایکسلریٹرز کے معاہدے پر دستخط کر لیے ہیں، جو تقریباً دس نیوکلیئر یونٹس کی مکمل پاور آؤٹ پٹ کے برابر ہے۔
华尔街见闻文章 میں لکھا گیا ہے کہ OpenAI کے چپ ہیڈ رچرڈ ہو نے کہا کہ کمپنی اب ایسے بجلی اور لاگت کے سطح تک پہنچ چکی ہے جس سے وہ بھی بنیادی ڈھانچے کی لاگت میں کمی لاسکتی ہے، "یہ صرف ایک پہلا قدم ہے"۔ انہوں نے اس بات پر زور دیا کہ NVIDIA اب بھی ایک اہم شراکت دار ہے، OpenAI کو کمپوٹنگ طاقت کی بہت بڑی ضرورت ہے اور وہ قریبی مستقبل میں اپنے موجودہ فراہم کنندگان کو نہیں چھوڑے گی۔
ماہرین کا کہنا ہے کہ جلاپینیو کا اہمیت یہ نہیں کہ آج وہ کتنے نیوڈیا چپس کو بدل سکتا ہے، بلکہ یہ ثابت کرتا ہے کہ ایک AI کمپنی، AI ٹولز کا استعمال کرتے ہوئے، ریکارڈ وقت میں ایک حقیقی طور پر مقابلہ کرنے لائق چپ تیار کر سکتی ہے۔ یہ فلائرویل شروع ہو چکا ہے۔
