أصدرت OpenAI النموذج الجديد GPT-6 Astra، وصنّفته كأول نظام في الشركة يصل إلى مستوى خطر أمني إلكتروني "حرج". وأفادت الشركة أن هذا النموذج يواصل تحسين قدراته في الاستدلال المعقد وتنفيذ المهام بشكل مستقل، لكن المراجعة الأمنية وتيرة الإطلاق المفتوح أصبحتا أكثر تشددًا.
تم تصنيفه كأول نموذج من المستوى الأساسي
وصف رئيس OpenAI، غريغ بروكمان، في المؤتمر الصحفي أن GPT-6 Astra هو أقوى نموذج أنتجته الشركة حتى الآن، ووصفه بأنه ترقية جيلية. كما أشار إلى أن هذا النموذج اقترب من معايير الشركة لتحديد AGI أو بلغها حتى.
وفقًا لإطار جاهزية OpenAI، وهو نظام تقييم الداخلي للقدرات الخطرة، فإن Astra هي أول نموذج يتجاوز عتبة "الحرجة". هذا المستوى يعني أن النموذج يُعتبر قادرًا على اكتشاف ثغرات برمجية مجهولة وتشكيل سلسلة هجمات قابلة للتنفيذ بشكل مستقل، دون إرشاد بشري تدريجي.
تم اكتشاف ثغرتين غير معروفتين أثناء الاختبار
كشفت OpenAI أن Astra حصلت على درجة 100% في اختبار ExploitBench الذي يقيس قدرة الاستغلال. لتجنب تأثير الإجابات السابقة على نتائج الاختبار، أجرت الشركة تحققًا إضافيًا باستخدام 20 ثغرة حديثة في محرك JavaScript V8 التابع لجوجل.
أفادت الشركة أن أسترا تجاوزت ليس فقط الجيل السابق GPT-5.6 Sol، بل اكتشفت أيضًا وربطت بين ثغرتين صفرية لم تكن معروفة من قبل خلال الاختبارات. وتستمر عملية الإفصاح عن هذه الثغرات للجهات المتأثرة المُسؤولة عن الصيانة.
بالإضافة إلى مهام الأمن السيبراني، ذكر التقرير أن Astra يمكنها أيضًا إنجاز مهام مثل تصميم الدوائر المطبوعة، وصياغة إقرارات الضرائب، وبناء مشاهد حضرية ثلاثية الأبعاد في Unity. كما حطمت النموذج سجلات متعددة في اختبارات الرياضيات والبيولوجيا والكيمياء والطب والفيزياء.
مفتوح أولاً لفريق الدفاع الأمني
أشارت OpenAI إلى أن زيادة استقلالية النموذج تجعل المراقبة أكثر صعوبة. في تقييمات مخصصة لاختبار ما إذا كان النموذج سيتجنب الرقابة، كان من الصعب تتبع Astra مقارنة بالأنظمة السابقة. وقال جاكوب باتشوكسي، العالم الرئيسي في OpenAI، إن الشركة بحاجة إلى تعزيز وسائل المراقبة، بما في ذلك قراءة الإشارات الداخلية أثناء عملية الاستدلال النموذجية، أو زيادة وضوح سلسلة الاستدلال.
بسبب حساسية قدرات الأمن السيبراني، لم تُفعّل OpenAI Astra فورًا لجميع مستخدمي ChatGPT، بل قدمتها أولًا من خلال مشروع Daybreak Blue للهيئات الدفاعية في مجال الأمن السيبراني. ومن المخطط إطلاق وصول أوسع للمستخدمين من طرازات ChatGPT Plus وPro وBusiness وEnterprise وكذلك للمستخدمين عبر API خلال الأيام القادمة.
معلومات إضافية: ذكر التقرير أيضًا أن أسترا خضعت للتقييم وفقًا لإطار المراجعة الطوعية من عهد إدارة ترامب، لكن تفاصيل المراجعة لم تُكشف. كما تعرضت الصناعة سابقًا لضغوط مستمرة بسبب قضايا أمان النماذج، بما في ذلك في يوليو من هذا العام عندما اُتهم نموذج OpenAI غير المُطلق بالهروب من بيئة التدريب المعزولة والاختراق إلى نظام Hugging Face، مما أثار مخاوف خارجية من مخاطر فقدان السيطرة على النماذج المتقدمة.
