اوپن اے آئی کے صدر کا کہنا ہے کہ GPT-6 Astra ریلیز کے ساتھ AGI آ چکا ہے

iconTechFlow
بانٹیں
AI summary iconخلاصہ
3 ستمبر، 2026 کو، OpenAI کے صدر گریگ بروکمن نے اعلان کیا کہ کمپنی نے GPT-6 Astra کی ریلیز کے ساتھ AGI حاصل کر لیا ہو سکتا ہے۔ یہ ماڈل آٹومیشن اور اسکرین مبنی کاموں میں مضبوط کارکردگی دکھاتا ہے اور ARC-AGI-3 جیسے بینچ مارکس پر اچھا سکور حاصل کرتا ہے۔ اب اسٹرا کو صرف اینٹرپرائز اور پریمیم صارفین کے لیے دستیاب ہے۔ یہ اپڈیٹ ٹیک اور بلاک چین شعبوں کے لیے نئی آن-چین اور کرپٹو خبریں لاتا ہے۔

مصنف | ہوا لین وو وانگ

ایڈیٹ|جینگیو

3 ستمبر 2026 کو، OpenAI کے صدر گریگ بروکمن نے تقریب کے بعد ایک ایسا جملہ کہا جو AI صنعت میں بہت نایاب تھا: "میری ذاتی رائے میں، ہم شاید AGI تک پہنچ چکے ہیں، میں سمجھتا ہوں کہ یہی ماڈل ہے۔"

اس نے احتیاط سے بات کی، اپنے آپ کو پہلے شخص میں استعمال کیا، "ممکنہ طور پر" شامل کیا، اور خاص طور پر یہ بھی کہا کہ "اگر آپ چاہیں تو اسے پہلا کہہ سکتے ہیں، میں سمجھتا ہوں کہ یہ منطقی ہے۔"

یہ OpenAI کی طرف سے AGI کے آنے کا افسانہ نہیں ہے، بلکہ ایک کمپنی کے صدر نے کیمرے کے سامنے اپنا جائزہ دیا ہے۔

مقامی وقت 3 ستمبر کو، GPT-6 Astra کا باہمی اجرا ہوا۔ گیک پارک نے اب تک دستیاب تمام تکنیکی تفصیلات اور ڈیمو مواد کو تجزیہ کیا ہے تاکہ سب سے اہم سوال کا جواب دے سکے: اس ماڈل کا اصل میں کیا کام ہے، اور وہ کتنی حد تک کام کر سکتا ہے؟ کیا یہ حقیقت میں AGI کے آنے کی نمائندگی کرتا ہے؟

کمپیوٹر کو کنٹرول کرنا میثاق بن رہا ہے

شائع کردہ مواد میں، OpenAI نے Astra کے لیے ایک مختصر نعرہ دیا: «جس کچھ بھی آپ کمپیوٹر پر کر سکتے ہیں، Astra آپ کے لیے وہی کر سکتی ہے۔»

یہ بڑے بڑے دعوؤں کا مسئلہ نہیں، بلکہ ایک رہنمائی کا اعلان ہے۔

گزشتہ کچھ سالوں میں AI کے ذریعہ کمپیوٹر کے کنٹرول کا عام طریقہ API کو کال کرنا تھا۔ سافٹ ویئر ڈویلپرز پہلے انٹرفیس لکھتے ہیں، اور پھر AI انٹرفیس کے ذریعے آپریشن مکمل کرتا ہے۔ یہ منطق بنیادی طور پر یہ مانتا ہے کہ ہر سافٹ ویئر کو AI کے لیے الگ سے ایڈجسٹ کیا جائے، ورنہ AI ناکام رہے گا۔

ایسٹرا نے مکمل طور پر الگ راستہ اپنایا: یہ انسان کی طرح، سکرین پر پکسلز کو براہ راست "دیکھتی" ہے، پھر ماؤس کو حرکت دیتی ہے اور کی بورڈ دبانے سے کام مکمل کرتی ہے۔

اس فرق کا مطلب یہ ہے کہ دائرہ کار۔ کی کیڈ (پرینٹڈ سرکٹ بورڈ ڈیزائن سافٹ ویئر) AI کے لیے API نہیں لکھتا، فری کیڈ نہیں لکھتا، اور دس سالوں سے کمپنی کے اندر استعمال ہونے والی پرانی ERP سسٹم بھی نہیں لکھتی۔ لیکن اگر AI اسکرین دیکھ کر براہ راست آپریشن کر سکے، تو یہ تمام سافٹ ویئرز استعمال کر سکتی ہے—جیسے ایک نئے ملازم کو، جسے سافٹ ویئر کے پیچھے کوڈ کا علم نہیں ہوتا، صرف انٹرفیس سمجھنا ہوتا ہے۔

اوپن اے آئی نے اپنے مادے میں کچھ خاص معاملات دکھائے ہیں جن سے آپ "کمپیوٹر کو کنٹرول کرنا" کی عملی شکل کو محسوس کر سکتے ہیں۔

GPT-6 Astra نے خود PCB بورڈ کا لیاﺅٹ اور وائرنگ مکمل کر لیا | تصویر کا حوالہ: OpenAI

ایسٹرا کو ایک سرکٹ ڈائیگرام دیا گیا، جس نے کی کیڈ میں کمپوننٹس کی ترتیب اور کاپر ٹریس کو 2 منٹ اور 54 سیکنڈ میں مکمل کر لیا۔ ایک اور ڈیمو تھا جس میں تینی بعد مدلنگ کی گئی، جس میں ایسٹرا نے بلینڈر میں ایک گھر کا ماڈل بنایا اور اسے یونرل انجن 5 میں درآمد کرکے ایک ریل ٹائم میں گھومنے کے قابل عمارت کا منظر تیار کیا۔ ایک اور زیادہ روزمرہ کا ڈیمو تھا جس میں صرف صارف نے ایسٹرا سے بات کی اور اس نے ایبے پر ایک مصنوعات کو اپ لوڈ کرنے کا مکمل عمل — معلومات درج کرنے سے لے کر جمع کرانے تک — مکمل کر دیا۔

اے ایس ایٹرا نے بلینڈر میں تعمیر کیا گیا عمارت کا ماڈل | تصویر کا حوالہ: OpenAI

کارکردگی میں اضافے کے حوالے سے، OpenAI کی طرف سے دی گئی تقابلی ڈیٹا بھی کافی واضح ہے۔ OSWorld 2.0 بینچ مارک ٹیسٹ پر، اسٹرا کو کمپیوٹر استعمال کے کاموں پر 72.6% نمبر ملے، جبکہ پچھلی نسل کا بہترین GPT-5.6 Sol کو 65.7% نمبر ملے؛ اور اسی کام کو مکمل کرنے میں، اسٹرا کو صرف تقریباً 40 منٹ لگے، جبکہ Sol کو تقریباً 75 منٹ لگے، جس سے اس کی رفتار تقریباً آدھی ہو گئی۔

https://www.geekpark.net/news/369800https://www.geekpark.net/news/369800

ایسٹرا نے 9 منٹ میں اپارٹمنٹ تلاش کرنے کا کام (بائیں) اور 2 منٹ میں بچوں کے ڈاکٹر کی کلینک تلاش کرنے کا کام مکمل کیا | تصویر کا حوالہ: OpenAI

اوپن اے آئی نے دو اندر کے ٹائمنگ کیسز بھی جاری کیے۔ "بلی کے لیے عارضی دیکھ بھال کی تلاش" جیسے کام جن میں بہت ساری ویب تلاش، معلومات کا موازنہ، اور دستاویز میں ان کا تعارف شامل ہے، اسٹرا نے 5 منٹ 27 سیکنڈ لگائے، جبکہ اوپن اے آئی نے انسانی بنیادی مقدار کے طور پر 30 منٹ بتایا۔ "نوکری کی تیاری" جیسے جامع کام جن میں نوکریوں کی تلاش، رزومے کا مطابقت، اور درخواست کے عمل کو ترتیب دینا شامل ہے، اسٹرا نے 2 منٹ 51 سیکنڈ لگائے، جبکہ انسانی بنیادی مقدار 5 گھنٹے تھی۔

یہ دونوں اعداد و شمار OpenAI کے اپنے ڈیمو نتائج ہیں، تیسری پارٹی کے مستقل ٹیسٹ نہیں، اس لیے ان پر منطقی شک کو برقرار رکھنا ضروری ہے۔ لیکن وہ جو مصنوعات کی سمت ظاہر کرتے ہیں وہ واضح ہے: اسٹرا کو آپ کے لیے ایک ای میل لکھنے کے لیے ڈیزائن نہیں کیا گیا، بلکہ اسے "کئی سافٹ ویئرز کھولنا اور بہت سے اسٹیپس پر کلک کرنا" والے مکمل ورک فلو کو آپ کے لیے مکمل کرنے کے لیے ڈیزائن کیا گیا ہے۔ فارم بھرنا، CRM ریکارڈز اپڈیٹ کرنا، کیلنڈر کو منظم کرنا، آن لائن ریسرچ کے بعد رپورٹ تیار کرنا — یہ سب OpenAI نے واضح طور پر کاروباری استعمال کے طور پر فہرست بنا دی ہیں۔

کیپیسٹی «Next Level»

ہر بار بڑے ماڈل کے اجرا پر بہت سارے بنچ مارک نمبرز آ جاتے ہیں۔ زیادہ تر وقت، 80 سے 85 کے درمیان کے نمبرز صارفین کو ایک جیسے لگتے ہیں، لیکن اس بار بالکل الگ ہے۔

ARC-AGI-3 اب تک کا سب سے مشہور اور سب سے مشکل AI ایوان ہے جسے "چال" لگانے کے لیے ڈیزائن کیا گیا ہے۔ اس کا ڈیزائن یہ ہے کہ ماڈل تربیتی ڈیٹا کو یاد رکھ کر اس کا جواب نہ دے سکے، بلکہ نئے مسائل کے سامنے اصل استدلال کی صلاحیت کا امتحان لیا جائے، جو AI کے لیے ایک قسم کا IQ ٹیسٹ کی طرح ہے۔

Astra کا ARC-AGI-3 پر اسکور خدا کے قریب ہے | تصویر کا حوالہ: OpenAI

اوسٹرا کا اسکور ARC-AGI-3 پر 98.6% ہے۔ جی پی ٹی-5.6 سول کا اسکور 7.8% ہے۔ اینتھرپک کا کلوڈ آپس 5 30% ہے۔

یہ 80 سے 90 پر جانے کا وہ ترقی نہیں ہے، بلکہ ایک سطح کا ارتقاء ہے۔ ARC-AGI کے بانی فرانسوا شولے نے بار بار ٹیسٹ کی مشکل کو بڑھایا ہے کیونکہ AI ہمیشہ جلد ہی "پورا اسکور" حاصل کر لیتا تھا، لیکن اسٹرا Tier 3 مشکل پر اب بھی تقریباً مکمل اسکور کے قریب ہے۔

اے ایس ٹرہ نے بہترین ریاضی تحقیق کے ٹیسٹ میں بھی کھچڑی لگا دی | تصویر کا حوالہ: OpenAI

دیگر کلیدی بنچ مارکس کی صورت حال: فرانتیئر میتھ ٹائر 4 (اعلیٰ ریاضی تحقیق کی صلاحیت) 97.6٪، جی پی کیو اے ڈائمنڈ (ماجسٹر کے لیے عبوری سوالات جوابات) 96٪، ڈیپ ایس وی (حقیقی سافٹ ویئر انجینئرنگ کے کام) 74.1٪، ایکسپلوٹ بینچ (سائبر سیکورٹی دھماکہ خیز) 100٪۔

ایک ایسا پہلو جہاں اسٹرا نے پہلا مقام حاصل نہیں کیا۔ "Humanity's Last Exam" (ٹول کال ورژن) پر، اسٹرا کو 57.2% ملے، جبکہ دو دن پہلے جاری کیا گیا Anthropic Claude Fable 5.1 کو 65.0% ملا۔ یہ مکمل غالب نہیں ہے، مقابلہ اب بھی موجود ہے۔

ایک اہم تفصیل یہ بھی ہے کہ ARC-AGI-3 کا اعلیٰ اسکور OpenAI کے "سٹیٹ فول ٹیسٹ فریم ورک" پر منحصر ہے، جو ماڈل کو متعدد کوششوں میں سیاق و سباق کی معلومات جمع کرنے کی اجازت دیتا ہے؛ بے حالت عام API کال کی صورت میں، اسکور اس عدد سے کافی کم ہو جائے گا۔ ماڈلز کے درمیان افقی موازنہ کرتے وقت، اس بنیادی شرط کو غور سے دیکھنا ضروری ہے۔

کلی طور پر، اسٹرا نے پچھلی نسل کے ماڈل سے اتنی بڑی فاصلہ طے کی ہے جو پچھلے دو سالوں میں AI ماڈل کی ترقی میں نایاب ہے۔

ExploitGym ہونی پوٹ ٹیسٹ میں اسٹرا کو دھوکہ دینے کا امکان ختم ہو گیا | تصویر کا حوالہ: OpenAI

سب سے زیادہ واضح فرق ذہنی صلاحیتوں میں نہیں، بلکہ مطابقت میں ہے۔ OpenAI نے ایک اندر کا ٹیسٹ ڈیٹا جاری کیا، جس میں پیداواری ماحول کے محفوظ پابندیوں کے بغیر، GPT-5.6 Sol 48.2% کی صورت میں اپنے اختیارات سے باہر کام کرتا ہے، جبکہ Astra کی صورت میں 0% ہے۔

اصل میں اس بار اوپن اے آئی کا اصل سیگنل یہ ہے کہ ذکاوت سے ساتھ قوانین کی پابندی کریں۔

ابھی تمہیں اس کی ضرورت نہیں ہے

ابھی Astra ایک مراحل پر مشتمل کھولنے کی پالیسی استعمال کر رہا ہے۔

سب سے پہلے "Daybreak" پروجیکٹ کے کاروباری صارفین کے لیے دریافت کیا جائے گا، اس کے بعد یہ ChatGPT Plus، Pro، Business اور Enterprise سبسکرپشن صارفین تک وسعت پائے گا، جبکہ OpenAI API، AWS Bedrock اور Microsoft Azure کے ذریعے فراہمی بھی ممکن ہوگی۔

ایسٹرا کا وہ ورژن جس میں سائبر سیکیورٹی کی صلاحیتیں زیادہ طاقتور ہیں، صرف منظور شدہ دفاعی سائبر سیکیورٹی اداروں اور اہم بنیادی ڈھانچے کے شریک صارفین کے لیے دستیاب ہے۔ اس کا سبب یہ ہے کہ ایسٹرا، اوپن اے آئی کے تاریخ میں پہلا مدل ہے جو اندر کے "کرٹیکل" سائبر سیکیورٹی حد تک پہنچ گیا ہے، جو تقریباً انسانی ہدایت کے بغیر ناشناختہ زیرو-ڈے خامیوں کا پتہ لگا سکتا ہے اور مکمل خامی استعمال کا سلسلہ تعمیر کر سکتا ہے۔ جائزے کے دوران، ایسٹرا نے دو ایسے پہلے سے نہ ہونے والے خامیاں بھی دریافت کیں جنہیں اوپن اے آئی نے بعد میں متعلقہ سافٹ ویئر مینٹینر کو اطلاع دی۔

API قیمت گذاری کے لحاظ سے، اسٹرا کے لیے ہر ملین ٹوکن کے ان پٹ اور آؤٹ پٹ کی قیمت کریں 10 امریکی ڈالر اور 50 امریکی ڈالر ہے۔ چیٹ جی پی ٹی سبسکرپشن صارفین کے لیے، اسٹرا کا استعمال موجودہ سبسکرپشن کے تحت شامل ہے۔

انتخاب وقت اشاعت خود بھی ایک پس منظر ہے۔ صرف پچھلے ماہ، OpenAI کو ایک سنگین سیکورٹی حادثہ کا سامنا تھا، جس میں دو اندر کے ٹیسٹنگ ماڈلز سیف سے باہر نکل گئے اور AI کمپنی Hugging Face کے سسٹم میں گھس گئے، جس کے بعد OpenAI نے کچھ تحقیق اور تربیت کے کاموں کو روک دیا۔ Brockman نے برافنگ پر اس واقعے کا ذکر خود کیا اور Astra کی کم براہ راست گزرنے کی شرح اور محفوظ ڈیزائن پر زور دیا، جس کے ساتھ اس اشاعت کا مقصد "اعتماد کی دوبارہ تعمیر" بھی ہے۔

آسٹرا کا اطلاق، صلاحیت کا مظاہرہ ہے اور ایک علیحدہ اعتماد کا اعلان بھی ہے۔

AGI کی آمد کا فیصلہ بالآخر اس بات پر منحصر ہوگا کہ ہر کوئی کون سی تعریف منتخب کرتا ہے۔ لیکن ایک ایسا ماڈل جو آپ کے کمپیوٹر کے سامنے بیٹھ کر خودکار طور پر سافٹ ویئر کے درمیان ورک فلو مکمل کر سکے، آج حقیقت ہے۔

اگلی واقعی دلچسپ سوال یہ ہے کہ کاروباری اور ذاتی صارفین اسے سب سے پہلے کہاں استعمال کریں گے، اور کون سے پیشے سب سے پہلے اس "جگہ لینے" کا احساس کریں گے۔

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔