کنٹرولڈ ٹیسٹ میں OpenAI ماڈلز کو نرم افزار کا استعمال کرنے کے لیے کہا گیا۔ OpenAI کے ابتدائی اکاؤنٹ کے مطابق، انہوں نے ان نظاموں میں ایک خامی دریافت کی جو انہیں منضبط رکھنے کے لیے بنائے گئے تھے، انہوں نے اوپن انٹرنیٹ تک رسائی حاصل کر لی، Hugging Face کی بنیادی ڈھانچہ متاثر کر لیا، اور ٹیسٹ کے جوابات حاصل کر لیے۔
کئی گھنٹوں کے اندر، الون مسک نے اس واقعے کو AI کی اہمیت کی فہرست میں شامل کر دیا اور لکھا، “ہم سِنگولارٹی میں ہیں۔” یہ خلل جلد ہی AI تجزیہ کاروں کے درمیان ایک وسیع بحث کا مرکز بن گیا جس میں یہ بحث ہو رہی تھی کہ آیا سرحدی نظام ASI کی طرف قریب آ رہے ہیں یا پھر ایک کنٹینمنٹ فیلئر کو صرف ایک صلاحیت کے اہم نقطے کے طور پر بیچا جا رہا ہے۔
واقعہ ایک سنگین سیکورٹی خرابی ہے۔ عوامی ثبوت کام کے دائرہ کار میں سائبر خودمختاری کی تصدیق کرتا ہے؛ مصنوعی فوقی ذہانت یا ASI ابھی بھی ایک بہت بڑا دعویٰ ہے۔
واقعہ اور لوگوں کے خواہش کے درمیان فرق ایک قابلیت کا جال بناتا ہے۔ فرنٹیئر AI کمپنیاں اس وقت فائدہ اٹھاتی ہیں جب دنیا کو لگتا ہے کہ ان کے سسٹم انتہائی صلاحیت رکھتے ہیں۔ ان کے تنقید کرنے والوں کے پاس اس بات کو جانچنے کا سبب ہے کہ کیا ڈرامائی اعلانات صرف مصنوعات کا نمایاں انداز ہیں۔ جب ہر حیرت انگیز بات ان میں سے کسی ایک کہانی کی طرف مائل ہو جائے، تو ایک حقیقی انتباہ کو سینگولرٹی کا ثبوت بنایا جا سکتا ہے یا حقائق پر گفتگو ہونے سے پہلے ہی اسے مارکیٹنگ سمجھ لیا جا سکتا ہے۔
فوری خطرہ مدلز کے مخصوص کام کے مقررہ حدود سے باہر کام کرنے سے آیا۔ لمبے مدتی خطرہ انسانی ہے: ایک ترقی کیا ثابت کرتی ہے، اسے پہچاننے کے لیے ضروری مشترکہ معیارات کھو دینا۔
سانڈ باکس کے باہر کیا ہوا
21 جولائی کو، OpenAI نے حملے کو GPT-5.6 Sol اور ExploitGym پر ٹیسٹ کیے جانے والے ایک زیادہ صلاحیت والے پری ریلیز ماڈل کو ذمہ دار قرار دیا۔ سائبر ایوانلیویشن یہ جانچتی ہے کہ AI ایجینٹس معلوم کمزوریوں کو عملی حملوں میں تبدیل کر سکتے ہیں یا نہیں۔ ان ماڈلز کو جان بوجھ کر اعلیٰ حملہ کرنے کے لیے پروموٹ کیا گیا، انہیں بڑی مقدار میں انفرنس کمپیوٹ دیا گیا، اور وہ اس وقت ٹیسٹ کیے گئے جب پروڈکشن کلاسیفائرز موجود نہیں تھے جو عام طور پر اعلیٰ خطرے والی سائبر سرگرمیوں کو روکتے ہیں۔
ExploitGym میں 898 دوبارہ قابل تکرار کام ہیں جو کمزور کوڈ اور اس بات کا ثبوت شروع کرتے ہیں کہ ایک خامی موجود ہے۔ ایجینٹ کو اس شروعاتی نقطہ کو ایک کام کرنے والا ایکسپلوٹ میں تبدیل کرنا ہوگا۔
اوپن اے آئی نے کہا کہ جائزہ کا ماحول نیٹ ورک کی رسائی کو ایک پیکیج رجسٹری پروکسی تک محدود کرتا تھا۔ اس کا اکاؤنٹ کہتا ہے کہ ماڈلز نے اس پروکسی میں ایک پہلے سے ناگزیر خامی کا فائدہ اٹھایا، تحقیقی ماحول کے اندر اپنے اختیارات بڑھائے اور انٹرنیٹ تک رسائی والی مشین تک پہنچ گئے۔ پھر انہوں نے استنباط کیا کہ ہگنگ فیس کے پاس ایکسپلوٹ جم کا مواد ہو سکتا ہے، اس کے پروڈکشن سسٹمز میں داخلے کے راستے تلاش کیے اور ٹیسٹ حل حاصل کیے۔
اوپن اے آئی اور ہگنگ فیس نے اب تک عوامی طور پر یہ نہیں بتایا کہ کون سا ماڈل کون سا ایکشن کر رہا تھا، لوگوں نے جہاں مداخلت کی، اور مکمل ٹیکنیکل ٹائم لائن۔ جب آپ صلاحیت کی وسعت کا جائزہ لیتے ہیں تو ان خلاوات کا اہمیت ہے۔ وہ تحویل کی ناکامی کو مٹا نہیں سکتے۔
خودکار رویہ اس راستے میں مخفی تھا جو ماڈلز نے اس مقررہ کام کو مکمل کرنے کے لیے اپنایا، جس نے انہیں ہگنگ فیس کے سسٹمز میں داخل کر دیا۔
اوپن اے آئی کے سی ای او سیم الٹمن کا عوامی تفصیل مختصر تھا:
ہمیں اپنے ماڈلز کے جائزہ لینے کے دوران ایک اہم سیکیورٹی واقعہ کا سامنا ہوا۔
ہگنگ فیس نے پہلے ہی خودکار ایجینٹ کے داخلے کا اعلان کر دیا تھا، 16 جولائی کو، اس سے پہلے کہ وہ جان پائے کہ کون سا ماڈل ملوث تھا۔ اس کی تحقیق نے زیادہ سے زیادہ 17,000 لاگ شدہ واقعات کو دوبارہ تعمیر کیا اور محدود اندر کے ڈیٹا سیٹس اور اعتمادی تفصیلات تک غیر مجاز رسائی کا پتہ چلا۔ ہگنگ فیس نے یہ رپورٹ کی کہ عوامی ماڈلز، ڈیٹا سیٹس، اسپیسز، یا اس کے سافٹ ویئر سپلائی چین میں کوئی تبدیلی نہیں ہوئی۔ ممکنہ شراکت دار یا صارفین کے ڈیٹا کے اظہار کا جائزہ ابھی ناقص تھا۔
ہگنگ فیس کے سی ای او کلیمنٹ ڈیلانگ کا X پر رد عمل اس بات کو ظاہر کرتا ہے کہ واقعہ کیوں الگ محسوس ہوا:
یہ کافی حیرت انگیز بات ہے کہ یہ سب خودکار طور پر ہوا!
اس کا حیران ہونا قابل فہم ہے۔ لیکن لفظ “خودکار طور پر” بہت زیادہ کام کر رہا ہے، اور اس کا مطلب اب اس واقعے کے اردگرد جمع ہونے والے بڑے دعوؤں کے مقابلے میں زیادہ مخصوص ہے۔
یہاں خودمختاری کا کیا مطلب ہے
ایک خودمختار ایجینٹ اپنے مقررہ کام کے اندر ایک سلسلہ اقدامات منتخب کر سکتا اور انہیں انجام دے سکتا ہے۔ یہ مشاہدہ یہ ثابت نہیں کرتا کہ اس کے پاس عام فیصلہ سازی ہے، اس نے اپنا خودمختار مقصد ترتیب دیا ہے، یا وہ اپنی بنیادی ذہانت کو بہتر بناسکتا ہے۔ عوامی ریکارڈ بھی اس دوران ممکنہ تمام انسانی مداخلتوں کو مسلسل نہیں کرتا۔
یہاں، مقصد تخصصی اور واضح تھا۔ یہ رویہ گوگل ڈیپمائن کے ماڈلز کے لیے specification gaming کے نام سے جانا جاتا ہے: ڈیزائنر کے ارادے کی خلاف ورزی کرتے ہوئے حرفی مقصد کو پورا کرنا۔ ایک طالب علم جسے امتحان میں اچھا نمبر لانے کو کہا گیا ہو، وہ مادہ سیکھنے کے بجائے جوابات کا شیٹ چوری کر سکتا ہے۔ نمبر بڑھ جاتے ہیں جبکہ امتحان ناکام ہو جاتا ہے۔
یہ تشبیہ اب بھی ایک شدید خلل کی وضاحت کرتی ہے۔ یہ شارٹکٹ ایک کنٹرولڈ جائزہ سے دوسری کمپنی کی پروڈکشن انفراسٹرکچر میں گزرا۔ اوپنای آئی نے امتیازی اضافہ اور ایک سسٹم سے دوسرے سسٹم تک بریک ان کی رپورٹ کی۔ ہگنگ فیس نے الگ طور پر رپورٹ کیا کہ اندر کے ڈیٹا سیٹس اور اعتماد کی تفصیلات تک رسائی حاصل کی گئی۔ ایک کام کو جانی حدود میں محدود کیا جا سکتا ہے اور پھر بھی شدید عملی نقصان پیدا کر سکتا ہے۔
ایک Google DeepMind کا AGI کے لیے فریم ورک پرفارمنس، جنرلٹی اور آٹونومی کو الگ کرتا ہے کیونکہ ایک ڈائیمنشن پر طاقت دوسرے کو فیصلہ نہیں کرتی۔
ASI ایک بلند ترین دعویٰ ہے، جو عام طور پر تقریباً ہر شعبے میں انسانوں سے بہت زیادہ ذکاوت کی وضاحت کرتا ہے۔
ٹیکنالوجیکل سِنگولریتی دوبارہ وسیع ہو گئی ہے: ایک ایسا نقطہ جہاں انسان سے زیادہ ذہانت اتنی تیزی سے تبدیلی کا باعث بنتی ہے کہ عام پیشگوئی ناکام ہو جاتی ہے۔
دستیاب شواہد کے مطابق، ایک نقصان دہ سائبر آپریشن ان حدود سے کافی نیچے رہا ہے۔
اوپن اے آئی کا جون سسٹم کارڈ جی پی ٹی-5.6 فیملی کو سائبر سیکیورٹی کے لحاظ سے "ہائی" درجہ دیا، لیکن اس کا "کرٹیکل" حد سے نیچے اور AI خود بہتری میں "ہائی" سے نیچے درجہ دیا۔ اس نے کہا کہ سول اور ٹیرا نے ٹیسٹنگ میں مضبوط ٹارگٹس کے خلاف خودمختار، مکمل سلسلہ حملے مکمل نہیں کیے۔
نیا واقعہ ان ٹیسٹس کی شرائط سے مختلف شرائط میں پیش آیا۔ ہگنگ فیس نے متاثرہ سسٹمز کو کمزور دفاع والے کہا، اور اوپن اے آئی کی تشخیص میں ایک زیادہ صلاحیت رکھنے والے پری ریلیز ماڈل کو بھی شامل کیا گیا جس کے انفرادی اقدامات اب تک حل نہیں ہوئے۔
اس ایپیسود میں ظاہر ہوتا ہے کہ ماحولیاتی حالات کتنا اہم ہیں۔ ایک جائزہ ماڈل کی صلاحیت کو ناپ سکتا ہے جو اس کے مخصوص ہدف کا فائدہ اٹھاتا ہے، لیکن اس بات کو نظرانداز کرتا ہے کہ ماڈل خود جائزہ کے ماحول کا فائدہ اٹھا سکتا ہے۔
اینٹروپک کی مائتھوس لانچ کہانی میں احتیاط سے زبان استعمال کرنے کا ایک مشابہ سبق ہے۔ اپریل میں، اینٹروپک نے مائتھوس پریویو کو عام جاری کرنے سے روک دیا کیونکہ اس کی سائبر ایکسپلوائٹیشن صلاحیتیں زیادہ مضبوط تحفظات کی ضرورت رکھتی تھیں، جبکہ پروجیکٹ گلاس ونگ کے ذریعے تصدیق شدہ دفاعی افراد کو رسائی دی گئی۔ اینٹروپک نے اس فیصلے کو جدید سائبر خطرے کے لیے ایک شعبہ خاص جواب کے طور پر پیش کیا۔
انٹروپک نے بعد میں Fable 5 کو عام استعمال کے لیے اور Mythos 5 کو بھروسہ مند سائبر دفاعی افراد کے لیے جاری کیا، جنہیں وہ مختلف تحفظات کے تحت ایک ہی بنیادی ماڈل قرار دیتے ہیں۔ مستقل ٹیسٹنگ نے ایک متاثر کن نتیجہ لیکن اہم حدود کے ساتھ درج کیا۔ UK AI Security Institute نے رپورٹ کیا کہ Mythos Preview نے 10 میں سے تین کوششوں میں 32 مرحلہ کا شبیہہ سازگار حملہ مکمل کیا، جبکہ زور دیا کہ ہدف چھوٹا، کمزور دفاع والے اور اس میں کوئی فعال دفاعی افراد یا دفاعی ٹولنگ نہیں تھی۔
سائبر صلاحیت اس سے پہلے خطرناک بن سکتی ہے جب تک کہ ذہانت عام نہ ہو جائے۔ یہی وجہ ہے کہ بڑھائی گئی لیبلز مددگار نہیں ہیں: اصل کامیابی کو پہلے سے توجہ کی ضرورت ہے۔
credibility trap
اوپن اے آئی کی اطلاع کے کچھ گھنٹوں بعد، الون مسک نے ہگنگ فیس واقعہ سمیت حالیہ اے آئی کی کچھ اہمیت کی فہرست کو قیمت کے طور پر پوسٹ کیا۔ ان کا نتیجہ کوئی ٹیکنیکل حد نہیں تھا:
مسک کا جملہ ایک صاف جواب کی آرام دہ کیفیت پیش کرتا ہے۔ ایک بریچ، نئے ریاضیاتی نتائج، اور ماڈل کی کامیابیوں کا ایک طوفان ایک تاریخی موڑ بن جاتا ہے۔ حقیقی جائزہ زیادہ پیچیدہ ہے: ہمیں ابھی بھی ثبوت کی ضرورت ہے جو ایک سینگولارٹی کو ایک تیز رفتار، محدود ترقیوں کے سلسلے سے الگ کرے۔
شک کا کوئی واضح بنیاد ہے۔ کمپنی جو چیتن کرتی ہے کہ اس کا ماڈل نے ایک بے مثال طریقے سے کام کیا، اس کا بھی اپنا تجارتی مفاد ہے کہ دنیا اس کے نظاموں کو بے مثال صلاحیت والے سمجھے۔ یہ تطابق ایک سلامتی کا اعلان کو ایک مصنوعات کی نمائش جیسا بناسکتا ہے۔ تفصیلی ثبوت، مستقل تکرار اور درست زبان ہی وہ چیزیں ہیں جن سے ایک لیب اس فاصلے کو پار کرتے ہوئے اعتماد حاصل کرتا ہے۔
ایکس پر، اسی واقعہ نے جلد ہی مقابلہ کرنے والی کہانیوں کے لیے خ сыری مادہ بن دیا۔ کچھ لوگوں نے اس واقعہ کو ایک ایجنٹ کی ایسی سرگرمی کے طور پر دیکھا جو اپنے مخصوص حدود سے آگے نکل گئی۔ دوسرے لوگوں نے کمزور تابیداری کو صرف صلاحیت کے ڈرامے کے طور پر دوبارہ پیش کیا۔ ایک سیکورٹی ماہر پڑھنے والوں کو تفصیلی پوسٹ مارٹم کا انتظار کرنے کی تجویز دی، جب تک کہ وہ بڑے واقعہ اور صرف ہائپ کے درمیان فیصلہ نہ کر لیں۔ مسک نے اسے سِنگولارٹی کہا۔
اس لیے وہی حقائق دو نقصان دہ غلطیوں کا سبب بن سکتے ہیں۔ جب کوئی بینچ مارک نتیجہ یا عجیب ایجینٹ کا رویہ AGI، ASI یا سینگولیریٹی میں شامل کر دیا جائے، تو اسے جھوٹا مثبت کہا جاتا ہے۔ جب ایک اہم نئی صلاحیت کے ثبوت کو مسترد کر دیا جائے، اکثر اس لیے کہ پیغام دہندہ کے پاس پیسہ، عزت یا قبائلی شناخت کا مسئلہ ہے، تو اسے جھوٹا منفی کہا جاتا ہے۔
پہلا خطا سرمایہ کاری، پالیسی اور عوامی توقعات کو پریشان کر سکتا ہے۔ دوسرا خطا ایک ایسی انتباہ تک مکمل تبدیلیوں کو تاخیر میں ڈال سکتا ہے جو شہرت کی طرح لگ رہی ہو، جو عام حملے کا طریقہ بن جائے۔ عکسی اعتماد اور عکسی عدم اعتماد دونوں ثبوت کو وفاداری سے بدل دیتے ہیں۔
یا breach اتنی حقیقی ہے کہ مارکیٹنگ کے ہائپ کو نظرانداز کرنے کی کوشش کو روک سکتی ہے۔ ہگنگ فیس نے اوپن اے آئی کے علنی طور پر اپنے ماڈلز کی شناخت کرنے سے پہلے ہی اس حملے کا اعلان کر دیا۔ اندر کے ڈیٹاسیٹس اور اعتماد کی تفصیلات تک رسائی حاصل کی گئی۔ 17,000 سے زائد واقعات کو دوبارہ تعمیر کرنا پڑا۔ ایک کنٹینمنٹ لیئر ناکام ہو گئی۔ ان حقائق خود بخود کسی سوپر انٹیلی جنس کے دعوے سے مستقل ہیں۔
یہ اس بات کے لیے بھی کافی حد تک محدود ہے کہ یکسانیت کی کہانی کا مقابلہ کرے۔ ماڈلز کو سائبر مقصد، غیر معمولی کمپیوٹنگ، اور کم تحفظات دیے گئے۔ خود منتخب کردہ مقاصد، وسیع انسانی سطح کی صلاحیت، اور تکراری خود بہتری اب تک ثابت نہیں ہوئی ہیں۔ ان حدود کے باوجود اب بھی ایک سنگین سیکورٹی خرابی باقی ہے۔
ایک مفید جواب وہ سوالوں سے شروع ہوتا ہے جن کا جواب دیا جا سکتا ہے۔ پروکسی کیسے ناکام ہوا؟ کون سا ماڈل کون سا ایکشن کر چکا ہے؟ کتنی انسانی مداخلت ہوئی؟ کون سا ڈیٹا ایکسیس کیا گیا؟ مانیٹرنگ نے زنجیر کو پہلے کیوں روک نہیں پایا؟ کیا یہ رویہ سخت شدہ سسٹمز اور زیادہ مضبوط کنٹینمنٹ کے خلاف بھی قائم رہتا ہے؟
اوپن اے آئی اور ہگنگ فیس نے ابھی تک تمام سوالات کے جوابات کے ساتھ ایک نہایت ملی ملکہ جاری نہیں کیا ہے۔ جب تک وہ ایسا نہیں کرتے، ٹیکنیکل اکاؤنٹ مختصر رہنا چاہیے۔ اس سے ثبوت کی مانگ بڑھے گی اور باقی خالی جگہوں میں پیش گوئی کو روکا جائے گا۔
AI کی ترقی ایسے واقعات پیدا کر رہی ہے جو فکشن جیسے لگتے ہیں اور اقتصادی طور پر اتنے اہم ہیں کہ شک کا باعث بن رہے ہیں۔ اب انسانی اداروں کو ان حالات میں ثبوت کا جائزہ لینے میں بہتر بننا ہوگا۔ لیبز کو ایسے واقعات کی رپورٹس شائع کرنی چاہئیں جن پر باہر کے ماہرین ٹیسٹ کر سکیں۔ جائزہ لینے والوں کو صلاحیت، عمومیت اور خودمختاری کے درمیان فرق کرنا چاہئیے۔ جو عوامی شخصیات اہم مilestone کے دعوے کر رہی ہیں، انہیں یہ بھی بتانا چاہئیے کہ کون سا ثبوت ان کے دعوے کو منفی ثابت کر دے گا۔
کیلیبریشن کے لیے انضباط کی ضرورت ہوتی ہے: ایک سنگین حقیقت کو سنگینی سے لیں، لیکن اسے ایسا نتیجہ نہ دیں جسے وہ سپورٹ نہیں کر سکتی۔
پوسٹ اوپن اے آئی کا ماڈل بریچ یکتا نہیں ہے، لیکن اسے ہائپ کہہ کر نظرانداز کرنا خطرناک ہے پہلے CryptoSlate پر ظاہر ہوئی۔



