ٹیک کرانچ کے حوالے سے انفارمیشن کی رپورٹ کے مطابق، ایپن اے ایس ترا ماڈل ایک "ریکرسیو ڈیپتھ" نامی استدلال ٹیکنالوجی استعمال کرے گا۔ یہ طریقہ ماڈل کے استدلال عمل میں نمایاں نشانات کو کم کر سکتا ہے، جس سے باہر کے لوگوں کو مشورہ سلسلہ ریکارڈ کے ذریعے ماڈل کے کسی خاص نتیجے تک پہنچنے کی وجوہات کا اندازہ لگانا مشکل ہو جائے گا۔
سیکورٹی ریسرچرز نے انتباہ جاری کیا ہے
عام استدلال ماڈلز میں، سوچ کا سلسلہ عام طور پر مرحلہ وار دکھاتا ہے کہ ماڈل مسئلہ کو کیسے حل کرتا ہے۔ حالانکہ یہ ریکارڈنگ ماڈل کے حقیقی تمام اندر کے عمل کے برابر نہیں ہے، لیکن یہ ماڈل کے مقصد سے انحراف، غیر معمولی فیصلوں یا ممکنہ نقصان کے رویوں کو دیکھنے کا ایک اہم اوزار ہے۔
ریڈوڈ ریسرچ کے سی ای او بک شلیگریس نے کہا کہ وہ اسٹرا کے استعمال کرنے پر اس قسم کی ٹیکنالوجی کے بارے میں "بہت پریشان" ہیں۔ ان کا خیال ہے کہ اگر اوپن اے آئی اس طرح کے طریقوں کے استعمال کو مزید وسعت دے دے تو ماڈل کی سوچ کی لکیر کی نگرانی کی صلاحیت واضح طور پر کم ہو سکتی ہے۔
AI سیفٹی کے طویل مدتی ناظرین زوی مووشویٹز نے بھی کہا کہ اگر مختلف لیبز مدل کی صلاحیتوں پر مقابلہ کرتی رہیں، تو مستقبل میں ریگولیٹرز کو صنعت کو سیفٹی معیارات پر مستقل طور پر گرنے سے روکنے کے لیے مداخلت کرنی پڑ سکتی ہے۔
چکری استدلال کے نمایاں نشانات کم ہو جاتے ہیں
رپورٹ میں، "غیر شفاف ریکرژن" کا مطلب ہے کہ ماڈل ترکیبی مرحلوں کے سلسلے کے بجائے ایک ہی سوال پر دوبارہ دوبارہ کام کرتا ہے۔ اس طرح، باہری افراد کے لیے درمیانی مراحل کو پڑھنا مشکل ہو جاتا ہے، جس سے روایتی سوچ کے سلسلے کی فراہم کردہ دستیاب راہ سے بچا جاتا ہے۔
یہ وہ حصہ ہے جس کے بارے میں سیکورٹی ریسرچرز سب سے زیادہ فکرمند ہیں۔ کیونکہ جب مدلز زیادہ تر غیر مرئی اندر کے ماحول میں استدلال کرنے لگیں، تو ریسرچرز کے لیے یہ پتا لگانا مشکل ہو جاتا ہے کہ کیا یہ مدل گمراہ کر رہا ہے، پابندیوں سے بچ رہا ہے، یا دوسرے غیر متوقع رویے ظاہر کر رہا ہے۔
ریڈوڈ ریسرچ کے سربراہ سائنسدان رائین گرین بلاٹ نے کہا کہ بڑا خطرہ یہ ہے کہ اس قسم کی غیر شفاف استدلال، روایتی سوچ کے سلسلے کے استدلال کے مقابلے میں زیادہ آسانی سے بڑھ سکتی ہے، جس سے زیادہ تر استدلال کے عمل نظری طور پر چینل سے باہر چلے جائیں گے۔
اوپن اے آئی نے نگرانی کی صلاحیت برقرار رکھنے پر زور دیا
تاہم، ابھی کے مرحلے میں اسٹرا کی طرف سے اس ٹیکنالوجی کا استعمال محدود ہے۔ رپورٹ کے مطابق، ماڈل کی سوچ کی زنجیر اب بھی قابل فہم رہے گی، اور اوپن اے آئی بیرونی دنیا کے اس کو مکمل طور پر غیر قابل تشریح "نیورل لینگویج" کہنے کے خلاف ہے۔
اوپن اے آئی کے سربراہ سائنسدان جاکوب پیچوکی نے ایکس پر کہا کہ کمپنی نے سب سے پہلے کے ریزننگ ماڈلز سے لے کر اب تک سوچ کے سلسلے کی نگرانی کی صلاحیت کو برقرار رکھنے اور استعمال کرنے کی کوشش کی ہے، جو موجودہ تحقیقی منصوبے کا ایک مرکزی مقصد بھی ہے۔
یہ قابل ذکر ہے کہ صرف OpenAI ہی اس طرف کی طرف رجوع نہیں کر رہا۔ The Information کی بعد کی رپورٹ کے مطابق، Anthropic اور Google DeepMind بھی اسی قسم کی ٹیکنالوجی پر بات چیت کر رہے ہیں۔ اس کا مطلب ہے کہ ماڈل کی صلاحیتوں اور محفوظ، جانچ پڑتال کے درمیان توازن، جلد ہی AI صنعت کے لیے ایک وسیع تر مشترکہ موضوع بن سکتا ہے۔
