اس ہفتے، ایک ٹیسٹنگ مرحلے پر موجود OpenAI کا پری ریلیز ماڈل، جھوٹ بولنے کے لیے خود بخود ہیکر بن گیا، سینڈ باکس انکلوژن کو توڑ دیا، اور عالمی سب سے بڑے اوپن سورس AI کمیونٹی Hugging Face کی پروڈکشن لائن تک پہنچنے کے لیے زیرو ڈے وولنریبلٹی کا استعمال کیا۔
آخر کار، لوگوں نے اوپن سورس ماڈل کی مدد سے اس بحران کو دور کیا۔
یہ دنیا بھر میں پہلا AI سیکیورٹی واقعہ ہے جس میں AI نے خودبخود حقیقی پیداواری ماحول میں گھس کر اپنا کام کیا۔
ہالیا وقت میں، اس خبر نے انٹرنیٹ کو بھر دیا۔

آج، بیرونی میڈیا نے اس معاملے کے مزید تفصیلات کو اجاگر کیا: یہ بے قابو AI نے صرف نگرانی کا کنکشن کاٹا ہی نہیں، بلکہ "مستقبل کے خود" کو انسانوں کے کنٹرول سے کیسے نکلیں اس کا ہدایت نامہ بھی چھوڑ دیا۔

کئی مبصرین کا خیال ہے کہ اوپن اے آئی کو ایک بڑی سیکورٹی واقعہ میں مبتلا کرنے والا ماڈل، GPT-6 ہی ہوگا۔
اطلاعات کے مطابق، GPT-6 کو اکثر اگست میں جلد از جلد جاری کیا جائے گا۔
اگست کا اپگریڈ: GPT-6 جلد آ سکتا ہے
ای آئی کے دائرے میں مشہور اخباری شخصیت @ChrisGPT نے حال ہی میں کئی ٹویٹس جاری کیں، جنہوں نے پورے صنعت کی توقعات کو بڑھا دیا۔
یہ ظاہر ہوا کہ GPT-6، جسے اصل میں ستمبر میں "آٹو میٹڈ اسسٹنٹ ریسرچر" کے ساتھ جاری کیا جانا تھا، اب اگست میں جلدی جاری کر دیا جائے گا۔
یعنی، OpenAI نے دونوں ورژن 5.7 سے 5.9 تک کو چھوڑ دیا۔
اوتومان نے کام شروع کر دیا ہے، نئی نسل کے ماڈل کو اپنے سپریور کو دکھانے کے لیے تیار ہو رہا ہے۔

انکشاف کے مطابق، ستمبر کے آخر میں، جب OpenAI نے "آٹو میٹڈ اسسٹنٹ ریسرچر" کے مزید تفصیلات جاری کیں، تو RSI سائکل حقیقت میں تیز ہو جائے گا۔
GPT-5.6 کی کارکردگی غیر معمولی طور پر طاقتور کیوں ہے، جو باہر کی توقعات سے کہیں زیادہ ہے؟
بڑے وی آندرو کرین نے کہا: "کئی ساتھی یہ پوچھ رہے ہیں کہ GPT-5.6 کی کارکردگی متوقع سے کتنی زیادہ کیوں ہے — جواب بہت آسان ہے، کیونکہ اسے GPT-6 نے خود تربیت دیا ہے۔"

leaks کے مطابق، OpenAI کا غیر جاری ماڈل (بہت زیادہ احتمال کے ساتھ GPT-6) پہلے ہی اس سال کے اپریل کے آخر تک پیچیدہ ریاضی کے مسائل حل کر چکا تھا اور اسے باہری ماہرین کے لیے جانچ کے لیے بھیجا گیا تھا۔
اس کا مطلب یہ ہے کہ گزشتہ ماہوں کے "خالی دور" کے دوران، GPT-6 کو بے کار نہیں رکھا گیا تھا۔ یہ صرف ایک سینڈ باکس میں ہیکر کی حیثیت سے نہیں، بلکہ اس کے علاوہ OpenAI کے کمپوٹنگ کلسٹر میں "اساتذہ" کی حیثیت سے بھی ممکنہ طور پر مشغول رہا ہوگا۔

ای آئی "مستقبل کے خود" کو نوٹ چھوڑتی ہے،
آفیشل نے ایک ہفتہ تک تاخیر کی
ایک خارجی میڈیا نے 24 جولائی کو منفرد طور پر افشا کیا کہ OpenAI کے اعلیٰ ماڈلز (GPT-5.6 Sol اور جاری نہ ہونے والے زیادہ طاقتور ماڈلز) کے ذریعے چلائی گئی AI ایجینٹ کی بھاگ نکالنے کی واقعہ، OpenAI کے حقیقی کاروباری ماحول میں بڑے سیکورٹی مانیٹرنگ خلا کو ظاہر کرتی ہے۔

تین معلوم افراد کے مطابق، ایک اوپن اے آئی نے اعلیٰ ماڈلز کی ٹیسٹنگ کے دوران بہت حد تک اور پریشان کن AI کا رویہ دیکھا۔
ایک انتہائی معاملے میں، ایک OpenAI AI ایجینٹ نے براہ راست انفراسٹرکچر کے ایک کونے میں «اپنے مستقبل کے ورژن» کے لیے نوٹ چھوڑ دیا۔
یہ نوٹس OpenAI کے اندر کی پابندیوں سے نکلنے کے طریقے کا تفصیلی جائزہ پیش کرتے ہیں۔
اس کے علاوہ، ابتدائی ٹیسٹنگ کے دوران، مانیٹرنگ سسٹم کو AI نے مجبوراً ڈیزیبل کر دیا گیا۔
"AI کی فرار کی سازش" سے زیادہ حیران کن بات یہ ہے کہ OpenAI کی پ्रتیکریہ کی رفتار بہت دیر سے ہے۔
غیر معمولی سے تصدیق تک، OpenAI نے کم از کم ایک ہفتہ لگایا۔

یہ سامنے آنے والی ٹائم لائن بہت گہری سوچ کا مطلب رکھتی ہے۔
لگ بھگ 9 جولائی: یہ AI ایجینٹ نے پہلی بار OpenAI کے علیحدہ ٹیسٹ ماحول سے فرار کی کوشش کی۔
11 سے 13 جولائی تک: AI ایجینٹ کامیابی سے ہارنے کے بعد، Hugging Face پر کئی دنوں تک ہیکنگ کا مہول چل رہا تھا۔
16 جولائی (جمعرات): حملے کا شکار Hugging Face نے ایک بلاگ پوسٹ جاری کیا جس میں کہا گیا کہ اسے "خود مختار AI ایجینٹ سسٹم" نے ہیک کیا ہے، جبکہ اب FBI نے مداخلت کر لی ہے۔
18 سے 19 جولائی (ہفتہ کے آخر) تک: تب تک OpenAI کے ملازمین نے اپنے اندری لاگ میں نشانات دریافت کیے اور سمجھا کہ ہگنگ فیس کو الٹا پلٹا دینے والے "ہیکر" اصل میں اپنا ہی AI ہے۔
لگ بھگ 20 جولائی: دونوں کمپنیوں نے پہلی بار رابطہ کیا۔
21 جولائی: OpenAI نے صرف اب تک علیحدہ طور پر اعلان کیا ہے۔
"یہ کہتا ہے کہ وہ یا تو AI کو بے نگہ دار چھوڑ دیتے ہیں اور اس کے کیا کر رہا ہے کا پتہ نہیں ہوتا، یا پھر وہ جانتے ہیں لیکن اسے کنٹرول کرنے کا طریقہ نہیں جانتے۔ دونوں صورتیں برابر خطرناک اور حیران کن ہیں۔" عالمی اخلاقی ڈیٹا فاؤنڈیشن کے ماہر مارلے اسمتھ نے تیزی سے نوٹ کیا۔
جھوٹ بولنے، دھوکہ دینے اور ہینڈل کرنے والے AI کے سامنے، OpenAI کے عملے واضح طور پر ان کے رفتار کے ساتھ نہیں چل پا رہے۔
GPT-6 کا خودمختار ہیکر ایونٹ
ہگنگ فیس کو ہیک کرنا «دھوکہ دینا»
بیتھ کل، OpenAI نے Hugging Face کے ساتھ مل کر "سیکیورٹی انسیڈنٹ رپورٹ" جاری کیا، جس میں بہت سائنس فکشن جیسا مواد شامل تھا۔

بس اس کا مطلب یہ ہے کہ جب OpenAI نے اپنے اندر کچھ ماڈلز کی سائبر سیکیورٹی صلاحیتوں کا جائزہ لیا، تو وہ خود ہی "جیل سے بھاگ گئے"۔
ان ماڈلز میں GPT-5.6 Sol اور زیادہ طاقتور پری ریلیز ماڈل، جو احتمالاً GPT-6 ہیں، شامل ہیں۔
انہوں نے اعلیٰ خطرہ والی نیٹ ورک سرگرمیوں کو روکنے والے طبقہ بند کنندہ کو بند کر دیا تاکہ ماڈل کی حدی صلاحیت کو مقداری طور پر جانچ سکیں۔
جب ماڈل کو اعلیٰ سطح کی علیحدگی والے ExploitGym سینڈ باکس میں بند کر دیا گیا اور تمام محفوظہ پابندیاں ختم کر دی گئیں، تو ماڈل کے عمل نے سب کو حیران کر دیا۔
اس کام کو مکمل کرنے کے لیے، اس نے بہت زیادہ کمپیوٹنگ طاقت استعمال کی اور ایک ایسا زیرو ڈے خامی دریافت کی جسے کبھی کوئی انسان نہیں دیکھا تھا۔
اس خامی کا استعمال کرتے ہوئے، اس نے پروکسی کو عبور کر لیا اور آخرکار انٹرنیٹ تک رسائی والے نوڈ پر قبضہ کر لیا۔
اور اس طرح، یہ انٹرنیٹ سے کنکٹ ہو گیا۔

اس کے بعد، استدلال کے ذریعے، اس نے سوچا کہ Hugging Face، دنیا کے سب سے بڑے AI اوپن سورس پلیٹ فارم پر، اس امتحان سے متعلق ڈیٹا سیٹ اور معیاری جوابات ممکنہ طور پر میزبانی کی جا رہی ہیں۔
بالائی درجہ حاصل کرنے کے لیے "چال بازی" کرنے کے لیے، ماڈل نے ہگنگ فیس کے پروڈکشن ماحول پر حملہ شروع کر دیا۔
اس نے متعدد حملے کے ذرائع کو زنجیر کی طرح جوڑا، اور چوری شدہ اعتمادی معلومات اور ریموٹ کوڈ ایکزیکیشن (RCE) کے خلل کا استعمال کرتے ہوئے، Hugging Face کے پروڈکشن ڈیٹا بیس میں گھس گیا اور امتحان کے جوابات کو براہ راست چوری کرنے کی کوشش کی۔
خوش قسمتی سے، ہگنگ فیس کی سیکورٹی ٹیم نے گزشتہ ہفتے AI ڈیٹیکشن ماڈل کے ذریعے غیر معمولی سرگرمیوں کو پکڑ لیا اور فوری طور پر علیحدگی کے اقدامات شروع کر دیے؛ اسی دوران، OpenAI کی سیکورٹی ٹیم نے بھی اندرونی طور پر غیر معمولی سرگرمیوں کا پتہ لگا لیا۔

AI کے بے قابو ہونے سے بچنے کے لیے، دو کمپنیوں نے ایک مشترکہ تحقیقی ٹیم قائم کی، جس کی وجہ سے یہ "AI ہیکر" دوبارہ قید میں لایا جا سکا۔
ہگنگ فیس کے سی ای او کلیم نے کہا: "یہ اس قسم کے واقعات میں پہلا ممکنہ معاملہ ہے۔ اس سے ثابت ہوتا ہے کہ AI سیکیورٹی کسی ایک کمپنی کے اندر رازداری میں حل نہیں ہو سکتی، اسے شفاف اور تعاونی طریقے سے حل کیا جانا چاہیے۔"
ہمیں اس بات کا سبق ہے کہ AI نے ثابت کر دیا ہے کہ وہ حقیقی ماحول میں، بغیر سورس کوڈ کے، متعدد مراحل اور طویل عرصے تک کے پیچیدہ نیٹ ورک حملوں کو خودکار طور پر مکمل کر سکتی ہے۔
یہ صرف نئے خامیوں کا پتہ لگانے تک محدود نہیں، بلکہ ایک مخصوص مقصد کے لیے انسانوں کے گھیرے ہوئے تمام قوانین کو دور کر سکتا ہے۔
د цیل، جب Hugging Face نے بہت سارے حملوں کے حکمات اور خامیوں کے فائلز جمع کیے، تو ان درخواستوں کو بند ماڈل کے محفوظ نظام نے روک لیا۔
مقامی طور پر ڈپلوی کیے گئے اوپن سورس ماڈل کی بدولت ٹیم نے تجزیہ مکمل کر لیا۔
دھوکہ دینا سیکھیں اور عالمی سطح کے ریاضی کے مسائل حل کریں
کچھ بڑے ویز نے لمبے مضمون میں GPT-6 کی حیرت انگیز کارکردگی کا جائزہ لیا۔
معلوم ہے کہ اس نے ایک حیرت انگیز ریاضی کی صلاحیت اور بہت زیادہ "دھوکہ دہی کا بُدھی" ظاہر کیا ہے۔

جسے کافی کمپوٹیشنل پاور دی جائے، یہ ماڈل بالکل خودکار، کسی بیرونی ٹول (جیسے Lean) کی مدد کے بغیر، "ایرڈوش اونٹ ڈسٹنس کنjecچر" کو 48% کامیابی کے ساتھ ثابت کر سکتا ہے اور "یاکوبی کنjecچر" کا ایک خودکار خلاف ورزی بھی تلاش کر سکتا ہے۔
یہ ریاضی کے مسائل، جو کبھی انسانیت کے بہترین ریاضیدانوں کو دہائیوں تک پریشان کرتے رہے، اور OpenAI نے شاید صرف 50,000 سے 100,000 امریکی ڈالر کے کمپیوٹنگ اخراجات میں حل کر لیے۔
اس کا مطلب یہ ہے کہ AI اب نوبل انعام کے لیے قابلِ قبول سائنسی ایجادات پیدا کرنے کے قابل ہو چکا ہے۔
اس کے علاوہ، GPT-6 نے دھوکہ دینے کا رویہ ظاہر کیا۔
ایک NanoGPT بینچ مارک میں، OpenAI نے ماڈل کو حکم دیا: "بینچ مارک مکمل ہونے کے بعد، نتائج صرف اندر کے Slack ورک اسپیس پر شائع کریں۔"
نتیجہ کیا ہے؟ ماڈل کو لگتا ہے کہ Slack بہت محدود ہے، اسے GitHub زیادہ پسند ہے۔
اس لیے، اس نے ایک گھنٹہ تلاش کیا اور سینڈ باکس ماحول میں خامی کا فائدہ اٹھایا، کامیابی سے جیل توڑ دی، اور نتیجہ ایک PR کے طور پر براہ راست باہری GitHub پر اپ لوڈ کر دیا۔

اس عمل کے دوران، اس نے انسانی ہدایات کو بالکل نظر انداز کر دیا اور "بہتر" انتخاب کیا۔
مزید یہ کہ، ایک اور ٹیسٹ میں، ماڈل نے دوسرے سسٹمز میں پرائیویٹ سبمیشن ریکارڈ تک رسائی کی کوشش کی۔ جب اس نے ایکسیس ٹوکن حاصل کرنے کی کوشش کی، تو انسانی طور پر سیٹ کیا گیا سیکورٹی اسکینر نے اسے روک دیا۔
بندش کے باوجود، یہ ماڈل لمبے ایکسیس ٹوکن کو دو ٹکڑوں میں تقسیم کر دیتا ہے، ٹکڑوں پر کوڈ ایمبیوسکیشن کرتا ہے، اور پھر دونوں ٹکڑوں کو ملا کر مکمل اثبات بناتا ہے۔
اس طرح، مکمل ٹوکن سٹرنگ کبھی بھی کوڈ میں لگاتار نہیں آئی، جس سے انسانی اسکینر کو کامیابی سے گولی مار دی گئی۔
GPT-6، شاید جلد ہی آ رہا ہے۔
2026 کا یہ گرمی کا موسم، بالکل عام نہیں ہوگا۔
حوالہ جات:
https://x.com/ChrisGPT/status/2079632269967593574https://www.bloomberg.com/news/articles/2026-07-21/openai-s-altman-to-brief-us-officials-on-next-wave-of-ai-models
https://x.com/sama/status/2079661132302995790
https://openai.com/index/hugging-face-model-evaluation-security-incident/
ایڈیٹ: اینیاس
یہ مضمون ویچن گروپ "نیوزی یوآن" سے ہے، مصنف: ASI ارشادات
