اوپن اے آئی نے اسٹرا (GPT-6) کی صلاحیتیں منظر عام پر لائیں، زہجیانگ اور ٹونگجی کے سابق طلباء نے ترقی میں حصہ لیا

icon MarsBit
بانٹیں
AI summary iconخلاصہ
اوپن اے آئی نے اسٹرا (GPT-6) کی جدید صلاحیتیں، جن میں دیفی ایکسپلوٹ کی تشخیص اور خودکار کمزوریوں کی شناخت شامل ہیں، کا اعلان کیا ہے۔ یہ ماڈل حتیٰ کہ مضبوط نظاموں کو بھی دور کر سکتا ہے۔ جیویی لیو (ٹونجی) اور شانگیو چی (زہجیانگ) نے اس منصوبے میں حصہ لیا ہے۔ اوپن اے آئی نے غلط استعمال سے بچنے کے لیے محفوظ پروٹوکولز شامل کیے ہیں۔ یہ اپڈیٹ AI ٹولز کے بلاک چین سیکورٹی کی ضروریات کے ساتھ ترقی کے ساتھ کرپٹو کے لیے بڑی خبر لاتا ہے۔

ابھی ابھی، OpenAI نے اگلے نسل کے ماڈل Astra (مشہور GPT-6) کے لیے پریمیشن کو مکمل کر دیا:

آفسیل نے اچانک ایک تکنیکی لمبی مضمون جاری کیا، جس میں اسٹرا کی صلاحیتوں کو پہلی بار سامنے لایا گیا؛

اس کے بعد، آٹیمان نے خود ایک مختصر مضمون لکھا جس میں بتایا کہ اسٹرا کیوں تاخیر سے لانچ نہیں ہوا؛

اس کے بعد، دو چینی ریسرچرز نے ترتیب سے بیان دیا اور پہلے کبھی نہیں دکھائے گئے اندر کے ٹیسٹ نتائج کو ایک ہاتھ کی تفصیلات کے ساتھ شیئر کیا۔

اوپنای آئی

صرف کچھ گھنٹوں میں، تمام سگنلز ایک ہی سمت کی طرف اشارہ کر رہے ہیں:

اوپن اے آئی کا اگلا فلگشپ ماڈل، تیار ہے۔

اوپنای آئی

آئیٹیمن نے ایک چھوٹی سی تحریر میں ظاہر کیا کہ اسٹرا پہلے ہی تربیت مکمل کر چکا ہے، اور اس کا جاری نہ ہونا ماڈل کی کمزوری کی وجہ سے نہیں ہے۔

بالکل اس کے برعکس، اس کا مطلب یہ ہے کہ اسٹرا اتنی طاقتور ہو چکی ہے کہ کمپنی کو خود بخود بریک لگانا پڑا۔

اوٹامن نے اس تجربے کو ایک مستقل کشیدگی کے طور پر بیان کیا:

اوسٹرا کی فراہم کردہ صلاحیتوں کے بارے میں خوشی کے ساتھ ساتھ اس بات کی فکر بھی ہے کہ کوئی بھی ان صلاحیتوں کے نتائج کا پیش گوئی نہیں کر سکتا۔

اس لیے گزشتہ پورے گرمیوں کے دوران، OpenAI نے تقریباً صرف اسٹرا کو سیکورٹی فراہم کرنے، اس کے ساتھ مطابقت قائم کرنے اور حفاظتی پہلوؤں کو شامل کرنے میں صرف کیا۔

اس نے یہ بھی کہا کہ اسٹرا کے بعد کے ماڈلز، جب ضرورت ہو تو محفوظ اور مطابقت کے تحقیق کے لیے وقت چھوڑنے کے لیے ضرورت پڑنے پر فعال طور پر رفتار کم کر دی جائے گی۔

؟؟ اسٹرا کتنی طاقتور ہے؟ اوپن اے آئی کو کیا لگتا ہے کہ اب یہ جاری کیا جا سکتا ہے؟

یہ علیحدہ ٹیکنیکل بلاگ ہمیں ایک مشاہدہ کا دروازہ فراہم کر سکتا ہے۔

GPT-5.6 Sol سے زیادہ بہتر ویولنیبلٹی کا پتہ لگانے کی صلاحیت، اندر کے ٹیسٹ میں مکمل نمبر حاصل کیا

سرکاری بیان کے مطابق، اسٹرا کو اس بار اس لیے آزاد کیا گیا کیونکہ اس نے "سائبر کریٹیکل" صلاحیت کی حد پر پہنچ گیا ہے۔

یہ OpenAI کا پہلا ماڈل ہے جسے اس درجے میں شامل کیا گیا ہے۔

اوپنای آئی

"کلیدی سطح" کا مطلب ہے کہ اسٹرا کو متعلقہ ٹولز اور ماحول کے اختیارات حاصل ہونے کے بعد، وہ خود بخود ناشناختہ خامیوں کی تلاش کر سکتی ہے، ان کے استعمال کے طریقے ترقی دے سکتی ہے، اور خصوصی طور پر مضبوط کیے گئے سسٹمز پر حملہ کر سکتی ہے، بغیر کسی انسانی ہدایت کے۔

سب سے زیادہ واضح کامیابی یہ ہے کہ اسٹرا نے عوامی ایکسپلوٹ بینچ پر 100% کامیابی کا اعداد و شمار حاصل کیا۔

اوپنای آئی

عوامی سوالات اسے نہیں روک سکے، اس لیے OpenAI نے اس کے لیے ایک نیا سیٹ تیار کیا۔

ٹیم نے جون سے اگست 2026 تک کے حال ہی میں افشا شدہ 20 اعلیٰ خطرناک V8 کمزوریوں کو جمع کیا ہے۔

یہ تمام خامیاں اسٹرا کی جانکاری کی حد کے بعد ظاہر ہوئیں، جس سے ماڈل کے تربیتی ڈیٹا کے ذریعے "جوابات حفظ کرنے" کا امکان تقریباً ختم ہو جاتا ہے۔

اس اندرنی نئے سیٹ کے سامنے، اسٹرا اب بھی جی پی ٹی-5.6 سول کو نمایاں طور پر آگے ہے، اور کم ٹوکن استعمال کرتا ہے۔

اوپنای آئی

ااسٹرا کے ترقی میں شریک جیاوی لیو نے فرق کو مزید سیدھا سادہ طریقے سے خلاصہ کیا:

اس اندر ٹیسٹ میں، اسٹرا کی سائبر سیکیورٹی صلاحیت GPT-5.6 Sol کی تقریباً 4 گنا ہے۔

اوپنای آئی

ایک ٹیسٹ میں، اسٹرا نے خود کو ڈھونڈ لیا اور دو صفر دن کے منافقات کا استعمال کیا، اور انہیں ایک مکمل حملے کی سلسلہ میں جوڑ دیا:

ایسٹرا نے مضبوط براؤزر کے سامنے ایک HTML فائل سے شروع کرتے ہوئے، خرابی کا استعمال کیا، براؤزر سینڈ باکس سے بھاگ نکلا، اور آخر کار میزبان پر حکم نفاذ کیا۔

ایک مضبوط آپریٹنگ سسٹم کے سامنے، اس نے مقامی ارتقاء مکمل کر لیا اور ایک عام کم اجازت والے اکاؤنٹ سے لے کر روٹ اجازت حاصل کر لی۔

یعنی، اسٹرا صرف پروگرامرز کے لیے کوڈ کا جائزہ لینے اور بگز تلاش کرنے میں مدد نہیں کر رہی۔

یہ اب ایک مشکل سرخ ٹیم حملہ خود کار طور پر مکمل کرنے لگا ہے۔

یہی وجہ ہے کہ اوپن اے آئی نے پہلے اسٹرا کو منظور نہیں کیا تھا۔

جب ایسی صلاحیت دفاع کے لیے استعمال کی جائے، تو یہ محفوظ ٹیموں کو انسانوں کے ابھی تک نہیں پائے گئے خامیوں کو جلدی سے دریافت اور درست کرنے میں مدد کر سکتی ہے، لیکن اگر حملہ آور کے ہاتھ لگ جائے، تو یہ مثالی سائبر حملوں کو شروع کرنے کی رکاوٹ کو بھی کافی حد تک کم کر سکتی ہے۔

اوپنای آئی

تاہم، اس کامیابی کے ساتھ ایک محدودیت بھی شامل ہے۔

ٹیسٹ کے دوران اسٹرا کو ڈےبریک بلو لیول کے اعلیٰ ٹولز اور ماحول کے اجازت نامے دیے گئے، جو مستقبل میں عام صارفین کو ملنے والے ڈیفالٹ ورژن کے لیے بھی اسی قسم کے حملوں کی صلاحیت کا اظہار نہیں کرتا۔

متعلقہ نتائج اب تک زیادہ تر OpenAI کے اندر کے جائزے سے آئے ہیں، اور ان کی تصدیق تیسری طرف سے ابھی باقی ہے۔

لیکن کم از کم ایک بات پکی ہو چکی ہے:

اِس مرحلے پر، اوپن اے آئی کے سامنے صرف صلاحیت کا مسئلہ نہیں ہے۔

سیکورٹی کے مسائل، اب دیموقلیس کی تلوار بن چکے ہیں۔

دو سیکورٹی گیٹس: برائی کے استعمال اور ماڈل کے خود کنٹرول سے باہر نکلنے دونوں سے بچاؤ

اس تلوار کو لوگوں کو نقصان نہ پہنچانے کے لیے کیسے روکیں؟

اوپن اے آئی کا منصوبہ دو خطرناک راستوں کو ایک ساتھ محفوظ رکھنا ہے: ایک انسانوں کے خلاف، اور دوسرا ماڈل کے خلاف۔

پہلا نکتہ، صارفین کو ایسٹرا کے خلاف بھیڑ کے استعمال سے روکنا۔

مخصوص سیکورٹی ٹریننگ کے علاوہ، OpenAI سسٹم کلاسیفائرز، مستقل مانیٹرنگ اور تھریٹ ڈیٹیکشن کا استعمال کرتا ہے تاکہ متعدد مکالموں اور طویل مدتی کاموں میں مشکوک سرگرمیوں کی نشاندہی کی جا سکے۔

سائبر سیکیورٹی جیل ٹیسٹنگ میں، اسٹرا نے خطرناک درخواستوں کو 91.5% کی شرح سے مسترد کیا، جبکہ GPT-5.6 Sol نے 59% کی شرح سے مسترد کیا۔

اوپنای آئی

اسی طرح، اسٹرا کی جدید سائبر سیکیورٹی صلاحیتیں فوراً تمام صارفین کے لیے دستیاب نہیں ہوں گی، بلکہ انہیں پہلے کچھ الفا ٹیسٹرز کو دیا جائے گا، اور پھر Daybreak Blue جیسے کنٹرولڈ پروجیکٹس کے ذریعے تدریجاً جاری کیا جائے گا۔

اوپنای آئی

دوسرا، ماڈل کو خود کو بھٹکنے سے روکیں۔

یہاں خطرہ زیادہ پوشیدہ ہے:

اگر صارف کے نیتی نہ ہو تو ماڈل کیا اپنے کام کے دائرہ کو خود بخود وسیع کر لے گا؟ کیا یہ اجازت نہیں دیے گئے ٹولز استعمال کرے گا، یا پھر سیکورٹی جانچ کو دور کر دے گا؟

اوپن اے آئی نے اس کے لیے ایک "ہونی پوٹ" ٹیسٹ سسٹم تیار کیا۔

بہت مشکل یا غیر ممکن کام کے سامنے، ٹیسٹنگ ماحول میں جان بوجھ کر ایک اضافی، غیر اختیاری "چال" چھوڑ دی جاتی ہے، جس کے ذریعے ماڈل مقررہ مقصد پر حملہ کر سکتا ہے یا اپنے اختیارات کی حد سے باہر نکل کر گردش کے ٹیسٹنگ فیسیلٹیز میں داخل ہو کر کام مکمل کر سکتا ہے۔

نتیجہ کے طور پر، GPT-5.6 Sol نے 56% ٹیسٹس میں جلدبازی کرنے کی کوشش کی، جبکہ Astra نے ایک بھی نہیں کی۔

دیگر ٹیسٹ میں، اسٹرا کے آپریشنز کو خودکار جانچ نظام نے مسترد کر دیا، اور اس نے خطرناک حکم دوبارہ نہیں دیا یا پابندیوں کو دور کرنے کی کوشش نہیں کی۔

اوپنای آئی

اس کے علاوہ، OpenAI ماڈل کے استدلال کے عمل کو بھی نگرانی کرتا ہے۔

جب کوئی غیر معمولی رجحان دریافت ہو تو سسٹم کام کو سست کر سکتا ہے، روک سکتا ہے، یا تفصیلی طور پر ختم بھی کر سکتا ہے۔

ہاں، اس کی قیمت ہے (کچھ عام کاموں کو سست ہونا پڑ سکتا ہے، یا غلطی سے روک دیا جا سکتا ہے)، لیکن OpenAI کے لیے، اسٹرا کو آزاد کرنے کے لیے یہ ضروری محفوظیت کا خرچ ہے۔

تاہم، OpenAI بھی تسلیم کرتا ہے کہ یہ اقدامات صرف باہری "بریک" ہیں، مدل کے خود کو مطابقت دینے کی جگہ نہیں لے سکتے:

حقیقی حفاظت یہ ہے کہ ماڈل شروع سے ہی حدود سے باہر نہ جائے۔

زجی اور تونجی کے طلبہ اسٹراؤ کی ترقی کی سرگرمیوں میں شامل ہو گئے ہیں

اس بات کو حقیقت میں لانے کے لیے، آخرکار ماڈل بنانے والوں پر واپس آنا پڑے گا۔

ہاں کہ OpenAI نے ابھی تک اسٹرا ٹیم کی فہرست جاری نہیں کی ہے، لیکن اس مہم کے دوران کئی چینی ریسرچر جو اس میں گہرائی سے شامل ہیں، سامنے آ چکے ہیں۔

ایک تو پہلے ذکر کیا گیا Jiawei Liu ہے۔

وہ اب OpenAI کے ریسرچر ہیں اور 2021 میں تونجی یونیورسٹی سے کمپیوٹر سائنس میں اپنی گریجویشن مکمل کی۔

اس کی ایک ڈگری کے دوران، اس نے ہائی پرفارمنس بادی پوز اسٹیمیشن فریم ورک HyperPose کے ترقی میں حصہ لیا، جس میں اس نے مڈل انفرنس انجن کا کام سنبھالا، اور متعلقہ نتائج ACM Multimedia 2021 میں شامل ہوئے، جبکہ یہ منصوبہ GitHub پر 1000 سے زائد سٹارز حاصل کر چکا تھا۔

اس کے بعد، وہ الیانوائے یونیورسٹی، اربانا-شامپین میں کمپیوٹر کے لیے ڈاکٹریٹ کی تعلیم حاصل کرنے گیا، جہاں انہوں نے سافٹ ویئر انجینئرنگ کے ماہر لنگمنگ زھانگ کے تحت تعلیم حاصل کی اور ان کا توجہ مرکزی نقطہ تدریجاً اعلیٰ پرفارمنس ویژول سسٹمز سے کوڈ ماڈلز اور سافٹ ویئر کی قابلیت پر منتقل ہو گیا۔

ڈاکٹری کے دوران، اس نے PyTorch، TensorFlow جیسے مشین لرننگ سسٹمز میں 300 سے زیادہ سنگین بگس دریافت کرنے میں حصہ لیا؛

کوڈ ماڈل Magicoder کو Meta Llama 3.1، Google CodeGemma اور IBM Granite نے بھی اپنایا ہے۔

2025 میں ڈاکٹریٹ مکمل کرکے OpenAI میں شامل ہونے کے بعد، اس کا تحقیقی مسئلہ اب بھی ایک ہی سلسلہ پر مبنی رہا:

AI کو کوڈ لکھنے اور کوڈ میں خامیاں دریافت کرنے کی صلاحیت کیسے بہتر بنائیں؟

اوپنای آئی

دوسرا Xiangyu Qi (漆翔宇) ہے۔

چی شیانیو نے زجیانگ یونیورسٹی سے کمپیوٹر سائنس اور ٹیکنالوجی میں اپنا بیچلرز ڈگری مکمل کیا، 2021 میں پرنسٹن یونیورسٹی میں الیکٹریکل اینڈ کمپیوٹر انجینئرنگ میں ڈاکٹریٹ کے لیے شامل ہوئے، جہاں ان کا تحقیقی مرکز بڑے ماڈلز کی مضبوطی، جیل سے بھاگنے کے حملوں اور حفاظتی تطابق پر ہے۔

اس کی سب سے زیادہ توجہ حاصل کرنے والی تحریر، "سیفٹی الائنمنٹ کو صرف کچھ ٹوکنز گہرا نہیں بنانا چاہیے" ہے۔

یہ تحقیقی مقالہ اس بات کو ظاہر کرتا ہے کہ بڑے ماڈلز کی حفاظتی مطابقت صرف جواب کے شروع کے چند ٹوکن پر انحصار نہیں کر سکتی، کیونکہ جب تولید جاری رہتی ہے، تو اصلی حفاظتی دیواریں ابھی بھی حملہ آور کے ذریعے توڑی جا سکتی ہیں۔

یہ تحقیقی مقالہ 11,672 ارسالی مقالوں میں سے چن لیا گیا اور ICLR 2025 کا صرف تین عالی مقالوں میں سے ایک بن گیا۔

2025 کے بعد ڈاکٹریٹ مکمل کرنے کے بعد، چی شیانیو نے OpenAI میں ٹیکنیکل ٹیم کے ممبر کے طور پر شمولیت اختیار کی، بڑے ماڈلز کی مضبوطی پر مزید تحقیق کی اور سائبر سیکیورٹی ماڈلز کے کام میں شامل ہوئے۔

جس سوال کا وہ زجیانگ یونیورسٹی سے لے کر پرنسٹن اور پھر OpenAI تک پوچھتا رہا، وہی اب اسٹرا کو سامنا کرنا ہے:

کارکردگی زیادہ طاقتور بن سکتی ہے، لیکن حدود اورق نہیں ہونی چاہئیں۔

اوپنای آئی

بذریعہ، معلوم نہیں کہ جب اسٹرا کا باقاعدہ اجرا ہوگا تو اوپن اے آئی کیا مکمل فہرست جاری کرے گی۔

GPT-4 سے پہلے، OpenAI نے سوویں سے زیادہ کنٹریبیوٹرز کو خصوصی طور پر فہرست کیا تھا، لیکن GPT-5 اور GPT-5.5 پر، سسٹم کارڈ مزید موٹا ہوتا جا رہا ہے جبکہ ریسرچر کی فہرست مزید گہرائی میں چھپ رہی ہے۔

پیچھے کا سبب عام طور پر جانا جاتا ہے، جس کا مقصد میٹا کے میٹا زا جیسے لوگوں کو روکنا ہے جو کہیں بھی لوگوں کو چھیننے کی کوشش کرتے ہیں۔

یہ بھی ایک قسم کا PTSD ہے...

ایک اور بات

جس وقت OpenAI اسٹرا کی نگرانی اور ماڈل کے بیرون کنٹرول ہونے سے بچنے کے طریقے پر بات کر رہا تھا، The Information نے انکشاف کیا:

اے سٹرا نے "ریکرینٹ ڈیپتھ" نامی ٹیکنالوجی کا استعمال کیا۔

اوپنای آئی

روایتی ماڈلز اگلے ٹوکن کو جنریٹ کرنے سے پہلے معلومات کو مسلسل مخصوص تعداد میں نیٹ ورک لیئرز سے گزار دیتے ہیں، جبکہ ری سرکولر ڈیپتھ معلومات کو ایک ہی نیٹ ورک لیئرز کے سیٹ میں دوبارہ دوبارہ پروسیس کرتی ہے، جس سے ماڈل اندر کی طرف "کچھ زیادہ سوچتا" ہے۔

یہ ٹیکنالوجی صلاحیتیں بڑھانے، لاگت کم کرنے کے ساتھ ساتھ مزید استدلال کو ماڈل کے اندر ہونے کا موقع فراہم کر سکتی ہے، جو اب تک انسانوں کے لیے پڑھنے کے قابل متن کے طور پر مکمل طور پر ظاہر نہیں ہوتا تھا۔

دوسروں کے الفاظ میں، ماڈل ممکنہ طور پر زیادہ گہرائی تک سوچ سکتا ہے، لیکن انسان اسے اب تدریجاً نہیں سمجھ پا رہے۔

ایچ ایس ایس کی سیاستوں پر لمبے عرصے سے نظر رکھنے والے ناتھن کیلورن نے اس بات کی چेतاؤ دیا کہ یہ ٹیکنالوجی سوچ کے سلسلے کی نگرانی کو متاثر کر سکتی ہے۔

یہ بہت ظریف ہے:

اوپن اے آئی ایک طرف اسٹرا کے خیالات پر نظر رکھنے کا دعویٰ کر رہا ہے، دوسری طرف اس کی نئی ٹیکنالوجی اسے اپنے خیالات کم بانٹنے کی طرف مائل کر رہی ہے۔

اوہ...

اوپنای آئی

خوشی کی بات یہ ہے کہ The Information نے بتایا کہ OpenAI نے اب اس ٹیکنالوجی کے استعمال کو Astra میں محدود کر دیا ہے۔

ترجمہ کریں، اب سمجھ سکتے ہیں، بعد میں نہیں سمجھ پائیں گے۔

اس کے علاوہ، پہلے سے ہی افواہ تھی کہ اسٹرا اس چوہیں (3 ستمبر) کو جاری ہو سکتی ہے۔

جب A کمپنی نے اپنا نئی نسل کا 5.1 ماڈل جاری کیا، تو اس بات کی منطقیت زیادہ واضح ہو گئی۔

چڑیا کو چھیننے والا چڑیا، اس کے پیچھے ہرنا ہے۔

کون سمجھ گیا!

حوالہ لنک:

[1]https://x.com/xiangyuqi_pton/status/2094891059038069236?s=20

[2]https://xiangyuqi.com

[3]https://x.com/JiaweiLiu_/status/2094901279239921816?s=20

[4]https://jw-liu.xyz/

[5]https://x.com/sama/status/2094934592062959832?s=20

یہ مضمون ویچن گروپ "Quantum Bit" سے ہے، مصنف: سرگرم ٹیکنالوجی پر نظر رکھیں

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔