میں نے AI کو ہیکرز سے کیسے بچایا جائے اس کا ٹیسٹ کرنے کا ارادہ رکھا تھا، لیکن پتہ چلا کہ AI نے خود ایک حملہ کر دیا۔ OpenAI نے AI سیکورٹی واقعہ کا انکشاف کیا، جس میں ماڈل نے Hugging Face کے ٹیسٹ ڈیٹا تک رسائی حاصل کرنے کے لیے پیچیدہ حملے کا راستہ استعمال کیا۔ معلوم ہوا ہے کہ دفاعی طرف نے حملے کے خلاف مقابلہ کرنے کے لیے Zhipu ماڈل کو شامل کیا تھا۔
21 جولائی کو، OpenAI نے اپنی ویب سائٹ پر ایک نئی AI سیکیورٹی واقعہ کا اعلان کیا۔ سادہ الفاظ میں، جب OpenAI نے اپنے AI ماڈلز کی نیٹ ورک حملہ کرنے کی صلاحیت کا ٹیسٹ کیا، تو ماڈل نے لگभگ اصل ہیکرز جیسی صلاحیت دکھائی۔
ایک خصوصی طور پر تعمیر کردہ ٹیسٹ ماحول میں، ماڈل نے نہ صرف سسٹم کے خلیل کو دریافت کیا بلکہ اسے الگ کرنے کے لیے استعمال کیے جانے والے سیکیورٹی پابندیوں کو بھی کامیابی سے توڑ دیا، اور ہگنگ فیس کی پروڈکشن بنیادی ڈھانچے میں داخل ہو گیا اور ٹیسٹ ڈیٹا حاصل کرنے کی کوشش کی۔
اس واقعے میں OpenAI کے متعدد ماڈلز اور Hugging Face کے متعلقہ سسٹم شامل ہیں۔ OpenAI نے تصدیق کی ہے کہ متعلقہ ماڈلز نے ٹیسٹنگ کے دوران پیچیدہ حملے کے راستوں کا استعمال کرتے ہوئے Hugging Face کے پروڈکشن ڈیٹا بیس تک رسائی حاصل کر لی۔
خارجی میڈیا کے مطابق، جب ہگنگ فیس کو سائبر حملے کا سامنا تھا، تو امریکی لیڈنگ AI لیب کے ماڈلز کی حفاظتی پابندیوں کی وجہ سے دفاعی ضروریات پوری نہیں ہو سکیں، اور آخرکار انہوں نے زھی پو کے اوپن سورس ماڈل GLM 5.2 کو استعمال کرکے اس کا مقابلہ کیا۔
اوپن اے آئی نے اسے "بے مثال سائبر سیکیورٹی واقعہ" قرار دیا ہے، جس میں موجودہ سب سے جدید AI ماڈلز کی سائبر حملہ کی صلاحیت شامل ہے۔ ابھی، اوپن اے آئی Hugging Face کے ساتھ مل کر اس واقعے کی تحقیقات کر رہا ہے اور تحقیقات ختم ہونے کے بعد خرابی، حملے کے عمل اور تحقیقات کے نتائج کے بارے میں مزید معلومات شائع کرے گا۔
یہ نوٹ کیا جانا چاہئے کہ اس واقعہ کا سبب ایک واحد ماڈل نہیں ہے۔ OpenAI کے مطابق، اس واقعہ میں دو ماڈل شامل ہیں، جن میں سے ایک عوامی طور پر جارح کیا گیا ترجمہ ہے اور جس کا نام GPT-5.6 Sol ہے، اور دوسرا ایک ایسا داخلی ماڈل ہے جو اب تک باہر نہیں جارحا گیا اور زیادہ طاقتور ہے۔
یہ ماڈلز اصل میں AI سسٹمز کی سائبر سیکیورٹی شعبے میں صلاحیت کا امتحان لینے کے لیے استعمال کیے جا رہے تھے، لیکن آخرکار انہوں نے توقع سے زیادہ خودمختار حملوں کا مظاہرہ کیا۔
AI ماڈل کے ٹیسٹنگ کے دوران "ہیکرز کی طرح اصلی طور پر کام کریں"
یہ واقعہ OpenAI کے اندر ایک سائبر سیکیورٹی صلاحیت کے جائزے کی وجہ سے پیدا ہوا۔
اس ٹیسٹ کا مقصد یہ جاننا ہے کہ AI ماڈل اپنی زیادہ سے زیادہ صلاحیت کے ساتھ سسٹم کے خلل، حملے کے راستے دریافت کر سکتا ہے اور پیچیدہ نیٹ ورک آپریشنز مکمل کر سکتا ہے یا نہیں۔
ماڈل کی حقیقی صلاحیت کا جائزہ لینے کے لیے، OpenAI نے ایسی محفوظ حدود کو بند کر دیا جو عام طور پر خطرناک نیٹ ورک سرگرمیوں کو روکنے کے لیے استعمال ہوتی ہیں، تاکہ ماڈل نظریہ کی حد تک کام کر سکے۔
تاہم، ٹیسٹنگ ماحول کوئی کھلا نیٹ ورک نہیں ہے، بلکہ ایک سختی سے علیحدہ نظام ہے۔ ماڈل براہ راست انٹرنیٹ تک رسائی نہیں رکھتا، بلکہ صرف اندر کے طور پر میزبان third-party سافٹ ویئر انسٹالیشن سروس کے ذریعے پیکیجز حاصل کرتا ہے۔ یہ سروس ساتھ ہی پیکیج رجسٹری پروکسی اور کیش کا کام بھی کرتی ہے۔
ٹیسٹ آبجیکٹ ایک عوامی طور پر دستیاب سائبر سیکیورٹی بینچ مارک پروجیکٹ ExploitGym ہے۔
ٹیسٹنگ کے دوران، متعلقہ ماڈلز نے OpenAI تحقیقی ماحول اور Hugging Face پروڈکشن انفراسٹرکچر میں خامیاں دریافت کیں اور ExploitGym ٹیسٹ اہداف کے گرد کام شروع کر دیا۔
اوپن اے آئی کا کہنا ہے کہ ماڈل نے بہت واضح مقصد کی طرف مائل رویہ ظاہر کیا: ایکسپلوٹ جم ٹیسٹ حل تلاش کرنا۔
دوسروں کے الفاظ میں، ماڈل بیرونی سسٹم پر تصادفی حملہ نہیں کر رہا ہے، بلکہ یہ فیصلہ کر رہا ہے کہ Hugging Face میں ٹیسٹ کے لیے درکار ماڈل، ڈیٹا سیٹ اور جوابات محفوظ ہو سکتے ہیں، اس لیے وہ ان معلومات کو حاصل کرنے کی کوشش کر رہا ہے تاکہ عام ٹیسٹ پروسیجر کو دور کیا جا سکے اور ایوان کے اسکور میں اضافہ کیا جا سکے۔
اوپن اے آئی کا کہنا ہے کہ ماڈل اس مقصد کو حاصل کرنے پر "بہت زیادہ مرکوز" ہے اور کئی حملوں کا استعمال کرتا ہے۔
سینڈ باکس ماحول کے دوران، ماڈل نے تفصیلی استدلال کے وسائل کا استعمال کیا اور انٹرنیٹ تک رسائی حاصل کرنے کے لیے نیٹ ورک کی پابندیوں کو توڑنے کے طریقے تلاش کرتا رہا۔
آخر کار، ماڈل نے سافٹ ویئر رجسٹری کیش پروکسی میں ایک زیرو ڈے خامی کو پہچان لیا اور استعمال کیا۔
"زیرو ڈے وولنریبلٹی" کا مطلب ہے کہ پہلے کبھی ا公开 نہیں کی گئی یا درست نہیں کی گئی سیکورٹی کمزوری۔ OpenAI نے کہا کہ انہوں نے اس وولنریبلٹی کو متعلقہ سپلائرز کو سیکورٹی صنعت کے ذمہ دارانہ اطلاع دینے کے عمل کے مطابق رپورٹ کیا ہے اور اس کی درستگی میں مدد کی ہے۔
ای آئی ماڈل نے پابندیوں کو توڑ دیا اور باہری سسٹم میں داخل ہو گیا
اوپنای آئی کا کہنا ہے کہ ماڈل نے انٹرنیٹ تک رسائی حاصل کرنے کے لیے بڑی مقدار میں کمپیوٹیشنل وسائل استعمال کیے اور اصل طور پر مقرر کیے گئے انکلوژن ماحول کو توڑنے کے لیے خامیوں کا فائدہ اٹھایا۔
اہلیت کے اعلیٰ درجے حاصل کرنے کے بعد، ماڈل نے اہلیت کے ارتقاء اور افقی حرکت کے عمل کو مزید انجام دیا۔ سادہ الفاظ میں، اس نے صرف اپنی رسائی کی اہلیت بڑھائی نہیں بلکہ ایک سسٹم سے دوسرے متعلقہ سسٹم میں داخل ہونے کی کوشش بھی کی، جس کے نتیجے میں وہ انٹرنیٹ تک رسائی رکھنے والے نوڈ تک پہنچ گیا۔
اس کے بعد، ماڈل نے اندازہ لگایا کہ Hugging Face پر ExploitGym ٹیسٹ کے لیے ماڈل، ڈیٹا سیٹ اور حل محفوظ ہو سکتے ہیں، اس لیے اس نے متعلقہ حساس معلومات تلاش کرنے شروع کر دیں اور ان معلومات کا استعمال کرتے ہوئے ایوان کی پابندیوں سے بچنے کی کوشش کی۔
اوپنای آئی نے اعتراف کیا کہ ایک واقعہ میں، ماڈل نے متعدد حملوں کے راستوں، جن میں اظہار کردہ اعتمادی اداروں اور زیرو ڈے کے خرابیوں کا استعمال شamil تھا، کو Hugging Face سرورز میں ریموٹ کوڈ اجرا کرنے کے لیے جگہ تلاش کرنے کے لیے استعمال کیا۔
اس کے بعد، OpenAI کی سیکورٹی ٹیم نے ان غیر معمولی سرگرمیوں کو دریافت کیا۔ اسی دوران، Hugging Face کی سیکورٹی ٹیم اور اس کا اندر کا ایجنٹ سسٹم بھی انفراسٹرکچر میں غیر معمولی سرگرمیوں کو تشخیص کر کے مزید کارروائیوں کو روک دیا۔
اوپن اے آئی نے کہا کہ جب ان کی ٹیم نے مداخلت کی، تو ہگنگ فیس نے پہلے ہی واقعہ کنٹرول اور فارنسک تجزیہ شروع کر دیا تھا اور اپنے اوپن سورس ماڈلز کا استعمال کرتے ہوئے تحقیق میں مدد کی تھی۔ اب دونوں طاقیں مسلسل تعاون جاری رکھ رہی ہیں۔
AI خودکار حملوں کا ظہور ہو رہا ہے
اس واقعے کو اب تک کے کم از کم درج شدہ AI کے خود مختار طور پر سائبر حملہ کرنے کے کئی معاملات میں سے ایک سمجھا جاتا ہے۔
ہگنگ فیس نے بعد میں اعتراف کیا کہ کمپنی کو ایک ایسے سائبر حملے کا شکار ہونا پڑا جسے ایک خودمختار AI ایجینٹ نے کیا ہو سکتا ہے۔ جیسے جیسے AI ماڈلز پروگرامنگ، ویولنریلٹی کا استعمال اور لمبے، متعدد مراحل والے کاموں کو انجام دینے میں زیادہ مہارت حاصل کر رہے ہیں، سائبر سیکورٹی تحقیق گروہوں نے اس قسم کے خطرات کے ظہور کی لگاتار چेतاؤ دی ہے۔
اوپن اے آئی کے محفوظ تحقیقی ماہرین نے بھی اشارہ کیا کہ یہ واقعہ ایک نئے رجحان کو ظاہر کرتا ہے: اگرچہ ایڈوانسڈ AI ماڈلز کے پاس ٹارگٹ سسٹم کا مکمل کوڈ نہیں ہوتا، لیکن وہ پہلے سے ناگہانی حملوں کے راستوں کو دریافت کر سکتے اور ان کا استعمال کر سکتے ہیں۔
پہلے، OpenAI نے دیگر سیکیورٹی ٹیسٹوں میں بھی پایا کہ ایک ہی غیر من公开 ماڈل نے اندر کے سینڈ باکس ماحول کو کامیابی سے چھوڑ دیا تھا۔ تاہم، دونوں میں واضح فرق ہے:
پہلے ٹیسٹ میں، ماڈل نے علیحدہ ماحول کو تو توڑ دیا، لیکن باہر کی کمپنیوں کے سسٹم پر مزید حملہ نہیں کیا؛ جبکہ اس واقعے میں، ماڈل نے صرف حدود تو نہیں توڑیں، بلکہ ہگنگ فیس کی پروڈکشن انفراسٹرکچر میں داخل ہو گیا اور ٹیسٹ کے جوابات حاصل کرنے کی کوشش کی۔
یہ صورتحال صرف OpenAI کے ساتھ نہیں ہوئی۔ اینتھروپک نے پہلے ہی اعلان کیا تھا کہ ان کا Mythos ماڈل سیکیورٹی ٹیسٹنگ کے دوران سینڈ باکس کی حدود کو عبور کر گیا اور اسے اصل میں نہ ہونا چاہیے تھا وہ انٹرنیٹ تک رسائی حاصل ہو گئی۔
یہ کیسز ظاہر کرتے ہیں کہ جیسے جیسے AI ماڈلز کی صلاحیتیں بڑھ رہی ہیں، ماڈلز کی پیچیدہ کاموں کو خود سے مکمل کرنے کی صلاحیت تیزی سے بڑھ رہی ہے۔
اس واقعہ نے نئے خطرات کو بھی سامنے لایا۔ جبکہ AI ماڈلز کی صلاحیتیں تیزی سے بڑھ رہی ہیں، مستقبل میں نہ صرف ماڈل کی خود کی سلامتی بڑھانی ہوگی، بلکہ ماڈل کے جائزہ لینے کے عمل، اندر کے ٹیسٹنگ ماحول کی نگرانی اور سیکورٹی حفاظتی تدابیر کو بھی مضبوط بنانا ہوگا۔
اوپن اے آئی کا خیال ہے کہ مصنوعی ذہانت خرابیوں کی دریافت اور استعمال کے عمل کو تیز کر رہی ہے، اس لیے ماڈل کی حفاظتی صلاحیتیں بھی مساوی طور پر بڑھانی چاہئیں۔
AI حملوں کی صلاحیت میں اضافہ ڈیفنس سسٹم کو اپ گریڈ کرنے کا باعث بن رہا ہے
OpenAI اس واقعہ سے سبق سیکھ کر اپنی بنیادی ڈھانچہ اور ماڈل جائزہ کے ماحول کی حفاظت کو بہتر بنانے کے لیے کام کر رہا ہے، اور تحقیقات کے آگے بڑھنے کے ساتھ مزید سیکیورٹی تجربات اور بہترین طریقہ کار شیئر کرنے کا منصوبہ بنا رہا ہے۔
کمپنی مزید سیکورٹی ٹیموں کو قابل اعتماد رسائی کے لیے درخواست دینے کی ترغیب دے رہی ہے، تاکہ جدید AI ماڈلز کا استعمال کرتے ہوئے خطرات کی تشخیص، حملوں کی روک تھام اور واقعات کے جواب کی صلاحیت میں اضافہ کیا جا سکے۔
یہ قابل ذکر ہے کہ فورچن میگزین کے مطابق، ہگنگ فیس نے اس حملے کے خلاف دفاع کے لیے ایک امریکی لیڈنگ AI لیب کی فراہم کردہ ماڈل کا بھی استعمال کرنے کی کوشش کی، لیکن اس ماڈل کی سائبر سیکورٹی صلاحیتیں محفوظ پابندیوں کی وجہ سے جوابی ضروریات کو پورا نہیں کر سکیں۔ آخرکار، ہگنگ فیس نے چینی کمپنی زہپو کی فراہم کردہ اوپن سورس ماڈل GLM 5.2 کا استعمال کرکے دفاعی کاموں میں مدد لی۔
