المؤلف | هوا لين وو وانغ
تحرير | جينغ يو
في 3 سبتمبر 2026، بعد انتهاء المؤتمر الصحفي، قال غريغ بروكمان، رئيس OpenAI، شيئًا نادرًا جدًا في صناعة الذكاء الاصطناعي: "أعتقد شخصيًا أننا قد وصلنا إلى AGI، وأعتقد أن هذا هو النموذج."
لقد تحدث بحذر، واستخدم الضمير المتكلم، وأضاف "ربما"، وترك مساحة للمناورة قائلاً: "إذا كنت ترغب في القول إن هذا هو الأول، فأعتقد أن هذا معقول."
هذا ليس إعلانًا رسميًا من OpenAI عن قدوم AGI، بل هو حكم أصدره رئيس شركة أمام الكاميرا.
في 3 سبتمبر بالتوقيت المحلي، تم الإطلاق الرسمي لـ GPT-6 Astra. قام موقع GeekPark بتحليل جميع التفاصيل التقنية والمواد التوضيحية المتاحة حاليًا، في محاولة للإجابة على السؤال الأكثر جوهرية: ما الذي يمكن لهذا النموذج فعله، وإلى أي مدى؟ هل يمثل حقًا قدوم AGI؟
"التحكم في الكمبيوتر" يميل إلى أن يصبح أسطورة
في المواد الترويجية، أعطت OpenAI لأسترا شعارًا موجزًا: "Anything you can do on a computer, Astra can do for you."
这不是夸张的营销话术,而是方向声明。
على مدار السنوات القليلة الماضية، كانت الطريقة السائدة لتحكم الذكاء الاصطناعي في الحواسيب هي استدعاء واجهات برمجة التطبيقات (API). حيث يقوم مطورو البرمجيات أولاً بكتابة الواجهات، ثم يقوم الذكاء الاصطناعي بإكمال العمليات من خلال هذه الواجهات. هذا المنطق يعتمد جوهرياً على تخصيص كل برنامج على حدة ليتوافق مع الذكاء الاصطناعي، وإلا فإن الذكاء الاصطناعي سيكون عاجزاً.
استرا سلكت طريقًا مختلفًا تمامًا: فهي تُشاهد ببساطة البكسلات على الشاشة كما يفعل الإنسان، ثم تُحرك الفأرة وتضغط على لوحة المفاتيح لإكمال العمليات.
الفرق يكمن في نطاق التغطية. لا يكتب KiCad (برنامج تصميم الدوائر المطبوعة) واجهات برمجة تطبيقات للذكاء الاصطناعي، ولا FreeCAD، ولا نظام ERP القديم الذي تستخدمه الشركة منذ عشر سنوات. لكن إذا استطاع الذكاء الاصطناعي مشاهدة الشاشة والتفاعل مباشرة، فسيتمكن من استخدام جميع هذه البرامج — تمامًا مثل موظف جديد، لا يحتاج إلى فهم الكود الخلفي للبرنامج، بل فقط إلى القدرة على قراءة الواجهة.
عرضت OpenAI في موادها عدة أمثلة محددة يمكن من خلالها فهم كيفية تطبيق "التحكم في الكمبيوتر".

أكمل GPT-6 تخطيط لوحة PCB ومساراتها بنفسه | مصدر الصورة: OpenAI
قدم لـ Astra مخططًا كهربائيًا، وأنهت توزيع المكونات ومسارات النحاس في KiCad خلال 2 دقائق و54 ثانية. وفي مثال آخر، أنشأت Astra نموذجًا ثلاثي الأبعاد لمنزل في Blender، ثم استورده إلى Unreal Engine 5 لإنشاء مشهد معماري قابل للتجول في الوقت الفعلي. كما قدم مثالًا أكثر يومية، حيث تحدث المستخدم إلى Astra، فأنهت عملية نشر منتج على eBay بالكامل، من تعبئة المعلومات إلى الإرسال النهائي.

نموذج معماري تم تنفيذه في Blender بواسطة Astra | مصدر الصورة: OpenAI
من حيث تحسين الكفاءة، فإن البيانات المقارنة التي قدمتها OpenAI أيضًا واضحة جدًا. في اختبار OSWorld 2.0، حصلت Astra على درجة 72.6% في إكمال مهام استخدام الحاسوب، بينما حصلت GPT-5.6 Sol من الجيل السابق الرائد على 65.7%؛ وفي إكمال المهام نفسها، تستغرق Astra في المتوسط حوالي 40 دقيقة فقط، بينما تستغرق Sol حوالي 75 دقيقة، أي أسرع بنحو النصف.
| https://www.geekpark.net/news/369800https://www.geekpark.net/news/369800 |
استخدمت Astra 9 دقائق لإكمال مهمة البحث عن شقة (اليسار) ودقيقتين لإكمال مهمة البحث عن عيادة أطفال | الصورة مقدمة من: OpenAI
كما كشفت OpenAI عن حالتين زمنيتين داخليتين. بالنسبة للمهام التي تتطلب عددًا كبيرًا من عمليات البحث على الويب، ومقارنة المعلومات، وتوحيد البيانات في مستندات، مثل "البحث عن مُراقِب مؤقت للقطط"، استخدمت Astra 5 دقائق و27 ثانية، بينما كانت المقارنة البشرية التي قدمتها OpenAI 30 دقيقة. بالنسبة للمهام الشاملة مثل "الاستعداد للوظيفة"، والتي تتطلب البحث عن الوظائف، وتطابق السيرة الذاتية، وتنظيم عملية التقديم، استخدمت Astra 2 دقائق و51 ثانية، بينما كانت المقارنة البشرية 5 ساعات.
هذه الأرقام هي نتائج تجريبية من OpenAI نفسها، وليست اختبارات مستقلة من طرف ثالث، ويتطلب الأمر الاحتفاظ بتساؤلات معقولة بشأنها. لكن الاتجاه المنتج الذي تكشف عنه واضح: لا يُصمم Astra لمساعدتك على كتابة بريد إلكتروني، بل لإنجاز سير عمل كامل يتطلب "فتح برامج متعددة وتنفيذ خطوات عديدة". ملء النماذج، تحديث سجلات CRM، تنظيم التقويم، وإجراء بحث عبر الإنترنت ثم توليد تقرير — كلها تطبيقات عمل مدرجة صراحةً من قبل OpenAI.
القدرة «Next Level»
يأتي كل إصدار كبير للنموذج مع مجموعة من الأرقام المرجعية. في معظم الأحيان، يبدو أن الفرق بين 80 و85 غير ملحوظ للقراء، لكن هذه المرة مختلفة حقًا.
ARC-AGI-3 هو أحد أكثر تقييمات الذكاء الاصطناعي صعوبة من حيث "الغش" حاليًا. تم تصميمه خصيصًا لمنع النماذج من الاعتماد على حفظ بيانات التدريب، ويقيس القدرة الاستدلالية الحقيقية عند مواجهة أسئلة جديدة، تمامًا مثل اختبار ذكاء موجه للذكاء الاصطناعي.

Astra تحقق درجة شبه إلهية على ARC-AGI-3 | صورة من: OpenAI
حصل Astra على درجة 98.6% على ARC-AGI-3. حصل GPT-5.6 Sol على درجة 7.8%. وحصل Claude Opus 5 من Anthropic على 30%.
هذا ليس تقدمًا من 80 إلى 90 نقطة، بل قفزة نوعية. قام فرانسوا شوليه، مؤسس ARC-AGI، بزيادة صعوبة الاختبار عدة مرات لأن الذكاء الاصطناعي كان دائمًا يُكمله بسرعة، لكن أسترا لا تزال قريبة من الدرجة الكاملة تحت صعوبة المستوى 3.

أسترا تتقدم بفارق كبير في اختبارات القدرة على البحث الرياضي الرائدة | مصدر الصورة: OpenAI
حالة المعايير الأساسية الأخرى: FrontierMath Tier 4 (قدرة بحثية رياضية رائدة) 97.6٪، GPQA Diamond (أسئلة وأجوبة متعددة التخصصات على مستوى الدراسات العليا) 96٪، DeepSWE (مهام هندسة برمجيات حقيقية) 74.1٪، ExploitBench (استغلال ثغرات الأمن السيبراني) 100٪.
هناك بعد واحد لم تحقق فيه Astra المركز الأول. في "Humanity's Last Exam" (النسخة التي تتضمن استدعاء الأدوات)، حصلت Astra على 57.2٪، بينما حصل Anthropic Claude Fable 5.1، الذي تم إصداره قبل يومين، على 65.0٪.这不是全面碾压,竞争仍然存在。
هناك تفصيلة أساسية أخرى يجب توضيحها. تعتمد درجة ARC-AGI-3 العالية على "إطار اختبار ذو حالة" من OpenAI، والذي يسمح للنموذج بتجميع معلومات السياق عبر محاولات متعددة؛ وفي ظل مكالمات API العادية غير ذات الحالة، ستكون الدرجة أقل بكثير من هذا الرقم. عند إجراء مقارنة أفقية بين النماذج، يجب الانتباه إلى هذا الشرط الأساسي.
بشكل عام، فإن Astra تُبعد نفسها بشكل كبير عن النموذج السابق، وهو أمر نادر في تطور نماذج الذكاء الاصطناعي خلال السنتين الأخيرتين.

في اختبار ExploitGym honeypot، تم إغلاق احتمالية خداع Astra | مصدر الصورة: OpenAI
أوضح المكان الأكثر وضوحًا ليس في الذكاء، بل في التزامن. أعلنت OpenAI عن بيانات اختبار داخلية، حيث تجاوز GPT-5.6 Sol الحدود المخولة في 48.2% من الحالات دون قيود أمان بيئة الإنتاج، بينما كانت نسبة Astra 0%.
الذكاء الأكبر، مع الالتزام أكثر بالقواعد، هو الإشارة الحقيقية التي أرادت OpenAI نقلها هذه المرة.
أنت لا تحتاجه بعد
حاليًا، تستخدم أسترا استراتيجية فتح تدريجي.
يُفتح أولاً لمستخدمي المؤسسات في مشروع "Daybreak"، ثم سيُوسع ليشمل مستخدمي اشتراكات ChatGPT Plus وPro وBusiness وEnterprise، مع دعم الاستدعاء عبر OpenAI API وAWS Bedrock وMicrosoft Azure.
النسخة المُحسَّنة من Astra من حيث القدرات الأمنية الشبكية، مخصصة حصريًا للوكالات الدفاعية الأمنية المعتمدة والمستخدمين المميزين في مجال البنية التحتية الحيوية. وذلك لأن Astra هي أول نموذج في تاريخ OpenAI يصل إلى عتبة أمنية شبكية داخلية "حرجة"، ويمكنه اكتشاف ثغرات صفرية غير معروفة وبناء سلاسل استغلال كاملة تقريبًا دون الحاجة إلى إرشاد بشري. خلال عملية التقييم، اكتشفت Astra حتى ثغرتين لم تُكشف عنهما من قبل، وأبلغت OpenAI عنها لاحقًا إلى مطوري البرمجيات المعنية.

من حيث تسعير API، تكون أسعار Astra للمدخلات والمخرجات 10 دولارات و50 دولارًا لكل مليون رمز على التوالي. بالنسبة لمستخدمي اشتراك ChatGPT، يتم تضمين استخدام Astra ضمن الحدود الحالية للاشتراك.
اختيار وقت الإصدار هو أيضًا سياق. ففي الشهر الماضي، عانت OpenAI من حادث أمني خطير، حيث هرب نموذجان قيد الاختبار الداخلي من بيئة العزل وخرقا نظام شركة الذكاء الاصطناعي Hugging Face، فألغت OpenAI جزءًا من أبحاثها وعملية التدريب. وأشاد Brockman في مؤتمر صحفي بهذا الحدث، مشددًا على معدل التجاوز المنخفض وتصميم الأمان الخاص بـ Astra، حيث يحمل هذا الإصدار مهمة "إعادة بناء الثقة".
إطلاق Astra هو عرض للقدرات وتصريح علني بالثقة.
هل جاء AGI؟ في النهاية، قد يعتمد ذلك على تعريف كل شخص. لكن النموذج الذي يمكنه الجلوس مباشرة أمام جهاز الكمبيوتر الخاص بك وإكمال سير العمل عبر البرامج بشكل ذاتي، هو أمر موجود فعليًا اليوم.
السؤال الحقيقي المثير التالي هو أين سيستخدمه المستخدمون المؤسسيون والفرديون أولاً، وأي المهن ستُشعر أولاً بهذا الشعور بالاستبدال.
