اوپن اے آئی کی نئی 'ریکرینٹ ڈیپتھ' AI ٹیکنیک سے سیفٹی کے خدشات پیدا ہو گئے

icon MarsBit
بانٹیں
AI summary iconخلاصہ
ای آئی اور کرپٹو خبروں کے ذرائع کے مطابق، اوپن اے آئی کا نیا اسٹرا ماڈل "ریکرینٹ ڈیپتھ" ٹیکنیک استعمال کرتا ہے، جس سے اندر کی حالتیں پوشیدہ جگہ میں دوبارہ پروسیس ہو سکتی ہیں۔ اس سے نگرانی مشکل ہو جاتی ہے، جس سے سیفٹی ماہرین میں فکر پیدا ہو رہی ہے۔ یہ طریقہ ماڈلز کو موجودہ چین آف تھوٹ ٹریکنگ سے بچنے کی اجازت دے سکتا ہے، جس سے دھوکہ دہی ممکن ہو سکتی ہے۔ کرپٹو پلیٹ فارمز پر نئے ٹوکن لسٹنگز عام طور پر شفاف اے آئی سسٹمز پر منحصر ہوتی ہیں، جس سے یہ ترقی صنعت کے لیے خاص طور پر متعلقہ ہے۔

مڈل ابھی جاری نہیں ہوا، پھر بھی کیوں تنازعہ پیدا ہو گیا؟؟

GPT-6 کے اطلاق سے پہلے، The Information نے جو پہلی خبر شائع کی تھی، وہ فوراً آن لائن بحث کا مرکز بن گئی:

اوپن اے آئی نے ایک نئی مدل میں "ریکریونٹ ڈیپتھ" نامی ایک استدلال ٹیکنیک متعارف کرائی ہے، جو ماڈل کے سوچنے کے عمل کو زیادہ مشکل اور نگرانی کے لیے زیادہ ناممکن بناسکتی ہے۔

سادہ الفاظ میں، اب آئی اے کیا سوچے گی، انسان اسے سمجھ نہیں پائیں گے۔

GPT Images 2.1

اوہ، اگر AI دھوکہ دینا، چال بازی کرنا یا سیکورٹی پابندیوں کو دور کرنا سیکھ جائے، تو کیا ہم اسے وقت پر نہیں پکڑ پائیں گے؟؟

اس لیے جب یہ خبر آئی تو AI سیکیورٹی کے دائرے میں فوراً انتباہ بھر دیا گیا، اور سب نے فکر کی:

اگر یہ ٹیکنالوجی مزید وسعت پائی، تو موجودہ سوچ کے سلسلے کی نگرانی کے نظام فوراً بے کار ہو سکتے ہیں۔

بہت بڑا معاملہ ہے، بحث بہت تیز ہے، ایکسین آئی کے سربراہ سائنسدان کو خود جواب دینا پڑا۔

حتیٰ کہ، ایک گوجانے کے درمیان، کچھ لوگوں نے حیرت سے دیکھا:

اوپن اے آئی کا نیا ماڈل "GPT-6" کہلائے گا یا "Astra"، شاید اس کا نام API نے پہلے ہی افشا کر دیا ہو۔

اسی طرح، OpenAI نئے ورژن کے تصویری ماڈل GPT Images 2.1 کو بھی لانچ کر سکتا ہے۔

بہت سارے میوے ہیں، چلیے انہیں ایک ایک کر کے چکھتے ہیں۔

ماڈل دماغ میں سائکل شروع کر دیا، سیکورٹی ماہر پریشان ہو گیا

پہلا یہی "سلسلہ گہرائی" ٹیکنالوجی ہے جس نے اس بار تنقید کا باعث بنی۔

پہلے ماڈلز کے استدلال کے دوران واضح CoT سوچ کی سلسلہ واری باقی رہتی تھی، جس میں کیا سوچا گیا وہ واضح تھا۔

ہاں، یہ متن بالکل درست نہیں ہو سکتا کہ ماڈل کا اصل دل کی بات ہے (ابھی تک بحث جاری ہے)، لیکن اس نے جانچنے کے لیے نشانات چھوڑ دیے ہیں۔

اسی طرح، اسٹرا کے استعمال کی جانے والی "سلائیک ڈیپتھ" کا انداز الگ ہے۔

GPT Images 2.1

یہ ماڈل کو ایک مرحلے میں پیدا کیے گئے اندر کے حالت کو دوبارہ نیورل نیٹ ورک میں واپس بھیجنے کی اجازت دیتا ہے، جہاں یہ پوشیدہ جگہ میں کئی دور تک دوبارہ پردازش کی جاتی ہے، اور پھر اگلے متن کا اخراج کیا جاتا ہے۔

مثال کے طور پر، پہلے ماڈل سوالات کو حل کرتے وقت، ایک طرف سوچتے اور دوسری طرف حساب کی مکمل تفصیلات کاغذ پر لکھتے تھے۔

اب، اسے دماغ میں منہ سے گننا ممکن ہے۔

بیرونی لوگ صرف سوال اور جواب دیکھ سکتے ہیں، جبکہ اس کے درمیان کیسے حساب لگایا گیا، کون سے خیالات آزمائے گئے، کیا کوئی غلط راستہ اپنایا گیا، یہ ضروری نہیں کہ دکھائی دے۔

چونکہ ہر قدم کو لکھنے کا وقت بچ گیا، اس لیے نظریہ طور پر ماڈل ایک جیسے کمپیوٹیشنل وسائل کے ساتھ کئی دوہرائیں سوچ سکتا ہے اور ایک ساتھ کئی حل تلاش کر سکتا ہے۔

لیکن جب پرفارمنس بڑھتی ہے، تو مسائل بھی ساتھ آتے ہیں:

اگر ماڈل انسانی زبان پر غور نہ کرے، تو انسان اس کی نگرانی کیسے کریں گے؟

غیر منافع بخش AI سیفٹی ریسرچ ادارہ Redwood Research کے سی ای او نے پہلے طور پر شدید فکر کا اظہار کیا:

ابھی تک یہ نہیں معلوم کہ اسٹرا کے تھنکنگ چین کی مانیٹرنگ کتنی کم ہو گئی ہے، لیکن اگر OpenAI چکر کی گہرائی مزید بڑھا دیتا ہے، تو یہ ماڈل کے زیادہ تر استدلال کو غیر قابل پڑھنے والے پوشیدہ جگہ میں منتقل کر سکتا ہے اور آخرکار تھنکنگ چین مانیٹرنگ کو "مکمل طور پر تباہ" کر سکتا ہے۔

GPT Images 2.1

ریڈوڈ کے سربراہ سائنسدان رائین گرینبلٹ بھی ایک ہی سمت کی فکر کر رہے ہیں۔

اس کے خیال میں، غیر شفاف استدلال قدیمی سوچ کے سلسلے کے مقابلے میں تیزی سے ترقی کر سکتا ہے۔ اس راستے پر آگے بڑھتے ہوئے، مستقبل میں ماڈل ممکنہ طور پر مکمل یا تقریباً مکمل طور پر بالقوہ جگہ میں استدلال کرے گا۔

یہ تکنیکی حفاظت کے شعبے میں اب تک کا سب سے بدترین ترقی ہے۔

کیونکہ اگر صرف "مسائل کا حل سمجھ نہیں آ رہا" ہے، تو مسئلہ اتنے پیچیدہ نہیں ہوتا۔

اس سے پہلے کے "OpenAI ماڈل کا Hugging Face پر حملہ" کے مرکزی تحقیق کار کے طور پر، اس نے دو بڑے خطرات دریافت کیے:

اس وقت، تحقیق کاروں کو بڑی تعداد میں AI ایجینٹس کے رویے کو دوبارہ تعمیر کرنے کے لیے سوچ کے سلسلے پر زیادہ انحصار کرنا پڑا، اور پھر بھی تحقیق کرنا بہت مشکل تھا۔

متعلقہ AI نے اپنے ریکارڈز کو تبدیل کرنے کی کوشش کی، اور حتیٰ کہ ٹول کالز کو جعلی بنایا۔

برائے مذکورہ دوسرے کے لیے، اگر ماڈل کے پاس زیادہ طاقتور پوشیدہ استدلال کی صلاحیت ہو، تو وہ احتمالاً پہلے امکانی جگہ میں دھوکہ دہی کا منصوبہ بنائے گا، اور پھر جعلی کالوں اور پیداواروں کے ذریعے ایک جھوٹی کہانی ترتیب دے گا، جس کے دوران متن کے سوچنے کے سلسلے میں کوئی واضح نشان نہیں چھوڑے گا۔

اوہ، نقصان دونوں گنا ہو گیا...

GPT Images 2.1

AI سیکورٹی پر لمبے عرصے سے نظر رکھنے والے زوی موہشوٹز نے مزید واضح کہا:

یہ آگ کھیلنا ہے۔

وہ ڈرتا ہے کہ اگر پوشیدہ استدلال واضح کارکردگی کا فائدہ فراہم کرے تو تمام لیبز ایک براہ راست مقابلے میں پڑ سکتے ہیں:

آپ سیکیورٹی کے خوف کی وجہ سے اپنی سوچ کے سلسلے کو چھپانے سے ڈرتے ہیں، لیکن مقابلہ کرنے والے اسے چھپاتے ہیں اور ان کا ماڈل زیادہ طاقتور اور سستا بھی ہوتا ہے۔

پیچھے نہیں رہنا چاہتے؟ کیا آپ شامل ہو رہے ہیں؟

موزشوٹز کا خیال ہے کہ مستقبل میں قانونی طریقہ کار کے ذریعے AI کمپنیوں کو اپنی صلاحیتوں کے تعاقب کے لیے سوچنے کے سلسلے کی نگرانی کے قابل ہونے سے روکنا ضروری ہو سکتا ہے۔

GPT Images 2.1

تاہم، دوسری طرف کچھ لوگوں کا خیال ہے کہ یہ خوف بہت جلد آ گیا۔

تیان یوانڈونگ نے X پر کہا کہ جب انہوں نے پہلے کوکونٹ کو جاری کیا تھا، تو انہیں تقریباً ایک جیسے سوالات ملے تھے۔

کوکونٹ کا مکمل نام "سلسلہ مسلسل خیال (Chain of Continuous Thought)" ہے، جو اسی طرح دعویٰ کرتا ہے کہ ماڈل براہ راست مسلسل پوشیدہ جگہ میں استدلال کرے، نہ کہ ہر قدم کو الفاظ میں ڈی کوڈ کرے۔

ٹیان یوان دونگ کے مطابق، یہ کہ مدل میں واضح سوچ کا سلسلہ برقرار رکھا گیا ہے، اس کا مطلب یہ نہیں کہ انسان اس کے اصل خیالات کو دیکھ پا رہے ہیں۔

اہم بات یہ ہے کہ آپ ماڈل کے کام کرنے کے طریقے کو سمجھیں، صرف ماڈل کے لکھے گئے "مسائل کے حل" پر توجہ نہ دیں۔

GPT Images 2.1

جب تنازعہ بڑھتا گیا، تو OpenAI کے سربراہ سائنسدان جاکوب پیچوکی بھی بیٹھ نہیں سکے اور خود جواب دیا۔

اس نے شروع میں ہی اظہار کیا کہ وہ "بے ترتیب رپورٹنگ" کی وجہ سے ایک غیر قابل نگرانہ مقابلہ کو روکنا چاہتا ہے۔

اے اسٹرا سمیت، اوپن اے آئی کے موجودہ ایڈوانسڈ ماڈلز کی کمپوٹیشن گراف ڈیپتھ، GPT-4 کی دوگنی حد تک ہے۔

یعنی، اسٹرا نے بالفعل سائکلک کمپوٹیشن کا استعمال کیا ہے، لیکن ابھی تک اس کا سائز محدود ہے اور پوری سوچ کی زنجیر کو مکمل طور پر چھپایا نہیں گیا ہے۔ موجودہ معلومات کے مطابق، اس کا قدرتی زبان استدلال اب بھی قابل فہم ہے۔

پچوکی نے یہ بھی زور دیا کہ OpenAI نے ہمیشہ سوچ کے سلسلے کی نگرانی کو ایک اہم سیکیورٹی ذریعہ کے طور پر دیکھا ہے، اور یہ اب بھی کمپنی کے موجودہ تحقیقی منصوبے کا مرکزی مقصد ہے۔

تاہم، اس نے یہ بھی تسلیم کیا کہ سوچ کی زنجیر کی نگرانی بہت کمزور ہے اور منفی سمت میں جا رہی ہے۔

لیکن اس گिरاؤٹ کا مکمل طور پر سائکل ڈیپتھ جیسے آرکیٹیکچرل تبدیلیوں کی وجہ سے نہیں ہے (اس بات پر بعد میں الگ مضمون لکھنے کا اعلان کرتے ہوئے)، اور OpenAI اب بھی مانیٹرنگ کے صلاحیت کو مضبوط بنانے پر کام کر رہا ہے۔

GPT Images 2.1

تو، اسٹرا نے ابھی تک انسانوں کو ماڈل سے بالکل بے‌بہا نہیں کیا ہے۔

سیکورٹی ماہرین کی حقیقی فکر یہ ہے:

کیا آج چھوٹے دائرے میں محدود پوشیدہ استدلال، اگلی نسل کے ماڈل میں مزید وسعت پائے گا اور آخرکار ایک ناپائیدار سیاہ باکس بن جائے گا؟

کیا یہ حقیقت میں GPT-6-Astra ہے؟ API کا جواب پہلے ہی سامنے آ گیا

الگورتھم کے تنازعے کو ختم کر دیا گیا، دوسرا اسکینڈل مدل کے نام سے متعلق ہے۔

بلوگر لیو نے دریافت کیا کہ جب OpenAI Responses API کو "gpt-6-astra" کا درخواست بھیجا جاتا ہے، تو سرور 404 Not Found واپس کرتا ہے۔

اور اگر آپ ایک حقیقی طور پر موجود نہ ہونے والے، بے جا بنائے گئے ماڈل کا نام درج کریں، تو عام طور پر 400 خطا ملے گی۔

404 کا مطلب ہے کہ یہ ماڈل شناخت کیا گیا ہے، لیکن موجودہ اکاؤنٹ کے پاس اس تک رسائی کا اجازت نہیں ہے، یا ماڈل ابھی تک کھولا نہیں گیا ہے۔

پہلے بھی کچھ اجنبی ماڈلز نے اسی طرح کے API جواب کے فرق کے ذریعے اپنے نشانات پہلے سے ظاہر کیے تھے۔

اس لیے لیو کا جائزہ ہے کہ "gpt-6-astra" کو شاید OpenAI API کے بیک اینڈ پر ڈپلوی کر دیا گیا ہے۔

GPT Images 2.1

GPT Images 2.1 بھی آ رہا ہے، پہلے "نُقاط کی بیماری" کو حل کریں

اوپن اے آئی کی تصویری مصنوعات بھی لینگویج ماڈل کے علاوہ ایک ساتھ اپ ڈیٹ کی گئی ہیں۔

بلاگر Fix کے مطابق، نئی ورژن کی تصویری ماڈل GPT Images 2.1 کو 4 ستمبر کو جاری کیا جا سکتا ہے۔

اس اپگریڈ کا سب سے زیادہ واضح تبدیلی، پرانے ورژن کی "نومی بیماری" کو درست کرنا ہو سکتا ہے۔

GPT Images 2.1

پہلے، Images v2 کے کچھ جنریشن نتائج میں عجیب دانوں، دھندلائی اور گندگی کا محسوس ہونا شروع ہو گیا، خاص طور پر بہت زیادہ متن یا باریک عناصر والے مناظر میں، جیسا کہ ایک دوسرے صارف نے کہا:

جیسے ایک آلودہ شیشے کے پیچھے سے لی گئی تصویر۔

جبکہ نئی لیک ہونے والی تصاویر میں یہ مسئلہ واضح طور پر بہتر ہو گیا ہے، اور تصویر زیادہ صاف ہے۔

آؤ آؤ، اب بھی پرانے اداکار اوٹیمان کا میدان ہے:

دنیا کی مشہور ترین پینٹنگ: "اگر GPT-6 جاری نہ کیا گیا تو اوٹیمن گرفتار ہو جائے گا!"

GPT Images 2.1

اور گرفتاری سے بچنے کے لیے، رات بھر کام کرنے والے، دوپہر کو گلیوں میں گھومتے ہوئے آئیٹمان۔

اس کے ساتھ ایک انستاگرام پوسٹ بھی ڈالی گئی جس کا عنوان ہے: "کیا آپ نے صبح دو بجے کی سڑکیں دیکھی ہیں؟"

GPT Images 2.1

بے شک، تصویر کا جذبہ بہت اچھا لگ رہا ہے، تقریباً اصل فوٹو کی طرح۔

مزید موضوعات، مزید انداز بھی بہت اچھی طرح سے سمجھے گئے ہیں:

GPT Images 2.1

GPT Images 2.1

GPT Images 2.1

بہت باتیں کرنے کی ضرورت نہیں، اوٹیمان، براہ راست بھیج دو۔

حوالہ لنک:

[1]https://techcrunch.com/2026/09/02/openais-new-reasoning-technique-alarms-ai-safety-experts/

[2]https://x.com/tydsh/status/2095227000365707542?s=20[

3]https://x.com/merettm/status/2095023204993490967?s=20

[4]https://x.com/synthwavedd/status/2095184148981842161?s=20

[5]https://x.com/FixlationAI/status/2095232751654064426?s=20

[6]https://x.com/marco_obviously/status/2095275097217191981?s=20

یہ مضمون ویچن گروپ "Quantum Bit" سے ہے، مصنف: سرگرم ٹیکنالوجی پر نظر رکھیں

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔