اوپن اے آئی کا نیا ماڈل اسٹرا کارکردگی اور محفوظیت پر بحث کا باعث بن گیا

iconMetaEra
بانٹیں
AI summary iconخلاصہ
اوپن اے آئی اپنے نئے اے آئی ماڈل اسٹرا کو لانچ کرنے جا رہا ہے، جو پیچیدہ استدلال کو بڑھانے کے لیے ایک نئی 'ریکرینٹ ڈیپتھ' تکنیک متعارف کرواتا ہے۔ یہ ماڈل GPT-4 کے بعد ایک بڑی کارکردگی میں اضافہ کا نشانہ ہو سکتا ہے، ممکنہ طور پر GPT-5 کو پیچھے چھوڑ دے۔ آن-چین خبروں کے مطابق، نئی ڈیزائن پورے چین آف تھوٹ آؤٹ پٹ کے بغیر گہرے استدلال کو ممکن بناتی ہے، جس سے شفافیت اور حفاظت کے بارے میں فکر پیدا ہو رہی ہے۔ اوپن اے آئی شفافیت برقرار رکھنے کے لیے اندر کے لوپس کو محدود کر رہا ہے، لیکن اے آئی تحقیقی برادری لمبے مدتی اثرات پر تقسیم ہے۔ ایکسچینجز پر نئے ٹوکنز کی فہرست بڑھتی ہوئی اے آئی سے چلائے جانے والے بلاک چین منصوبوں میں دلچسپی کو ظاہر کر سکتی ہے۔
اوپن اے آئی جلد ہی نیا ماڈل "اوسٹرا" جاری کرنے جا رہا ہے، جو AI تحقیق کے دائرے میں بڑی توجہ اور تنقید کا باعث بن رہا ہے — اس کی کارکردگی GPT-4 کے بعد سب سے بڑی کھچ پر مبنی ہو سکتی ہے، لیکن اس کے پیچھے کی نئی استدلال تکنیک کی وجہ سے AI سیکیورٹی مانیٹرنگ کی صلاحیت میں کمی کے خدشات بھی پیدا ہو رہے ہیں۔

مضمون کے مصنف، ذریعہ: The Information

ٹیک میڈیا The Information کے مطابق 2 ستمبر کو، اسٹرا ایک نوٹیک تکنیک کے ساتھ لانچ ہوا ہے جس کا مرکزی نقطہ ماڈل کی پیچیدہ مسائل کو "سوچنے" کی حد کو عبور کرنا ہے۔ کچھ تحقیق کاروں کا خیال ہے کہ اسٹرا کی کوڈنگ اور کمپیوٹر استعمال کی صلاحیتوں میں بہتری، OpenAI کے 2023 میں GPT-4 جاری کرنے کے وقت کی طرح ہو سکتی ہے، جو گزشتہ صيف GPT-5 کے لانچ سے بہت زیادہ ہے۔ اس سے پورے صنعت کے لیے، جو ڈیٹا سینٹر کے بڑے پیمانے پر تعمیر کے لیے AI پیداوار میں اضافے پر منحصر ہے، ایک مثبت سگنل ہے۔

تاہم، یہ ٹیکنالوجی کی کامیابی نے نظرانداز نہ کی جانے والی خطرات کو بھی لایا ہے۔ نئی ٹیکنالوجی ماڈل کو ناقص "سوچ کے سلسلے" کے ساتھ گہری استدلال کرنے کی اجازت دیتی ہے، جس کا مطلب ہے کہ تحقیق کار شاید پہلے کی طرح ماڈل کے استدلال کے عمل کو مؤثر طریقے سے نگرانی نہیں کر پائیں گے، جس سے موجودہ سیکورٹی جانچ کے نظام کمزور ہو جاتے ہیں۔ ابھی، OpenAI اس بات کو یقینی بنانے کے لیے اقدامات کر رہا ہے کہ اسٹرا کا سوچ کا سلسلہ قابل دیکھنے رہے، لیکن صنعت میں اس توازن کے طویل المدتی رجحان کے بارے میں اختلافات جاری ہیں۔

پرفارمنس کا بڑا ارتقاء: نئی استدلال تکنیک یا GPT-4 کی سطح کے ارتقاء کو دوبارہ حاصل کرنا، اسٹرا کی بنیادی تکنیکی کامیابیوں سے متعلق ہے جس میں "ریکرینٹ ڈیپتھ" اور "لوپ ٹرانسفارمرز" جیسے تصورات شamil ہیں۔

اینفورمیشن کے مطابق، یہ ٹیکنالوجی مسئلہ کو ماڈل کے ریاضیاتی "لیئرز" میں دہرائے جانے سے گزارتی ہے اور پھر جواب میں اگلا الفاظ تخلیق کرتی ہے، جس سے ماڈل اپنے اصل سائز کو نہ بڑھائے بغیر بہت زیادہ طاقتور استدلال کی صلاحیت دکھاتا ہے — جس کا اثر ایک بہت بڑے ماڈل کے برابر ہوتا ہے۔

کچھ تحقیق کاروں کا خیال ہے کہ اسٹرا کی بہتر کوڈنگ اور کمپیوٹر استعمال کی صلاحیت کی وجہ سے اس کی کارکردگی میں اضافہ 2023 میں GPT-4 کے اطلاق کے وقت کے جھٹکے والے ترقی کے برابر ہو سکتا ہے، جو گزشتہ صيف GPT-5 کے لانچ کے وقت کے نسبتاً ساکن مارکیٹ ردعمل سے کہیں زیادہ ہے۔

یہ ترقی پورے AI صنعتی زنجیر کے لیے اہم ہے۔ موجودہ عالمی ڈیٹا سینٹر کی بڑے پیمانے پر تعمیر کا بنیادی منطق یہ ہے کہ AI کی صلاحیتوں میں مستقل اضافہ پیداواری صلاحیت میں اضافہ لائے گا، جس سے زیادہ تجارتی منافع حاصل ہوگا۔ اگر اسٹرا کی کارکردگی متوقع سطح تک پہنچ جائے تو یہ سرمایہ کاری کے منطق کو مضبوط بنائے گا۔

یہ تکنیک نئی تصور نہیں ہے۔ AI تحقیق کے ابتدائی رہنما یورگن شمڈہوبر نے سوشل میڈیا پلیٹ فارم X پر اشارہ کیا کہ "ریکرسیو ڈیپنس" کا بنیادی خیال اصل میں ان کی 2015 کی تحریر "On Learning to Think" (arXiv:1511.09249) میں پہلے ہی موجود تھا۔

اس نے کہا کہ اس تحقیقی مقالے میں کنٹرول نیٹ ورک C بنیادی طور پر ایک پرومپٹ انجینئر ہے، جو الگ الگ نیورل ورلڈ ماڈلز کو کوئری کرنے کے ذریعہ انتزاعی استدلال سیکھتا ہے، اور پیدا کردہ پرومپٹس اور جوابات اندر کے خود-پیدا شدہ ویکٹر سیکوئنس ہوتے ہیں جنہیں قدرتی زبان میں پیش نہیں کیا جاتا۔

سیکورٹی خطرات: سوچ کے سلسلے کی نگرانی کا نظام نئی تکنالوجیوں کے سامنے چیلنج کا شکار ہے، جو کارکردگی میں اضافہ لاتے ہوئے موجودہ AI سیکورٹی نگرانی کے فریم ورک کو ممکنہ طور پر متاثر کرتی ہیں۔

رپورٹ کے مطابق، موجودہ وقت میں، ممتاز AI ماڈلز پیچیدہ مسائل کو حل کرتے وقت عام طور پر اپنے استدلال کے عمل کو متن کی شکل میں پیش کرتے ہیں، جسے "سوچ کا سلسلہ" (chain of thought) کہا جاتا ہے۔ یہ مکانزم نہ صرف ماڈل کی قابل تشریحیت بڑھاتا ہے، بلکہ تحقیق کاروں کے لیے ماڈل کے رویے کی نگرانی اور غیر معمولی سرگرمیوں سے بچنے کا اہم ذریعہ بھی ہے۔

انفویمیشن کے مطابق، سوچ کے سلسلے کی نگرانی، اوپن اے آئی کی طرف سے جولائی 2023 میں ہگنگ فیس پر ہونے والے ہیکر حملے کے بعد، اس قسم کے مزید سیکورٹی واقعات کو روکنے کا ایک اہم حل ہے۔

تاہم، ایسٹرا کی استعمال کی جانے والی نئی استدلال تکنیک، جب مدل گہرائی سے سوچ رہا ہو، تو استدلال کے مراحل کو مکمل طور پر باہر نہیں نکالتی، بلکہ انہیں مدل کے اندر "چپچپا" طور پر مکمل کرتی ہے۔ اس کا مطلب یہ ہے کہ جتنا مدل اس نئی تکنیک پر انحصار کرتا ہے، اتنا ہی اس کا استدلال عمل باہری نگرانوں کے لیے کم شفاف ہوتا جاتا ہے۔

اس کے لیے، OpenAI اب اسے متوازن کرنے کے لیے اقدامات اٹھا رہی ہے۔ کمپنی ماڈل کو یہ ہدایت دے رہی ہے کہ وہ حساب کتاب کے سطح پر حل کی دہرائی کم کرے تاکہ Astra کی سوچنے کی سلسلہ واری کچھ حد تک قابل دیکھنا رہے — جتنا کم دہرائی، اتنا ہی کم ماڈل کا "خاموشی سے سوچنے" کا موقع۔

بڑے لیبز نے اس پر کام شروع کر دیا ہے، اور اس ٹیکنالوجی کے طویل مدتی اثرات کا جائزہ لینے کے لیے ابھی تک کوئی منصوبہ تیار نہیں ہوا۔ The Information کے مطابق، یہ نئی استدلالی ٹیکنالوجی بڑے AI لیبز کے اندر بحث کا مرکز بن چکی ہے، اور Anthropic، گوگل جیسے اداروں کی طرف سے اسی طرح کے راستے پر چلنے کا امکان نظر انداز نہیں کیا جا سکتا۔

کئی تحقیق کاروں نے اشارہ کیا ہے کہ سوچ کے سلسلے کی نگرانی AI کے رویے کی نگرانی کا حتمی حل نہیں ہو سکتی۔ ماڈل کی صلاحیتوں کے مسلسل ترقی کے ساتھ، ماڈل کا سوچ کے عمل کو متن کے طور پر پیش کرنا اکثر موجودہ تربیت کے طریقے کا مصنوعی نتیجہ ہے۔

جب ماڈل ڈویلپرز نئے آپٹیمائزیشن کے رخ اور آرکیٹیکچر ڈیزائن کی تلاش کرتے ہیں، تو ماڈل کی خودبخود سوچ کے سلسلے کی پیداوار کی رجحان میں کمی آ سکتی ہے، اور اس وقت تحقیق کاروں کو نئے نگرانی کے طریقے تیار کرنے ہوں گے۔

رپورٹ کے مطابق، موجودہ مرکزی سوال یہ ہے کہ پرفارمنس کی تیز ہوتی ہوئی مقابلے کے دباؤ میں، تمام AI ڈویلپرز کیا موجودہ سیکیورٹی اقدامات کو ترجیحی طور پر چھوڑ دیں گے تاکہ زیادہ طاقتور استدلال کے صلاحیتوں کو حاصل کر سکیں؟ اس سوال کا جواب، اگلے مرحلے میں AI سیکیورٹی گورننس کے رخ کو بہت زیادہ متاثر کرے گا۔

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔