أعلنت OpenAI في 1 سبتمبر أن Astra، الذي لم يُصدر بعد، قد وصل إلى عتبة الأمن السيبراني "الحرجة" في إطار "الاستعداد" الخاص بالشركة. هذا هو أول مرة تُصنف فيها OpenAI نموذجًا ضمن هذا المستوى، مما يعني أن تطويره وإطلاقه سيخضعان لقيود أمنية أكثر صرامة.
الدخول الأول إلى المستوى الحرج
وفقًا لتعريف OpenAI، إذا تمكّن النموذج من اكتشاف ثغرات غير معروفة بشكل مستقل في أنظمة حقيقية معززة بعدة طرق وبناء سلاسل هجوم قابلة للاستخدام، أو إكمال هجوم شبكي كامل ضد أهداف صعبة للغاية بناءً على أهداف عليا فقط، فإنه يُصنف كـ"حرجة". سابقًا، كانت النماذج بما في ذلك GPT-5.6 Sol لا تتجاوز أعلى مستوى "عالي المخاطر".
تم اكتشاف ثغرتين صفرية أثناء الاختبار
في اختبار الاستغلال ExploitBench، حققت Astra معدل نجاح بنسبة 100%. يركز هذا الاختبار بشكل رئيسي على قدرة النموذج على تحويل الثغرات المعروفة في البرمجيات إلى كود استغلال قابل للتنفيذ.
لتجنب تأثير قواعد البيانات التذكارية، اختارت OpenAI 20 ثغرة أمنية خطيرة في محرك JavaScript Google V8 تم الإفصاح عنها بين يونيو وأغسطس من هذا العام لإجراء اختبارات داخلية. وصرحت OpenAI أن Astra تفوقت على GPT-5.6 Sol من حيث نسبة النجاح في تنفيذ التعليمات البرمجية العشوائية، مع استخدام عدد أقل من وحدات الإخراج. خلال الاختبار، اكتشفت Astra أيضًا بشكل مستقل وربطت بين ثغرتين صفرية لم تكن معروفة من قبل، ولا تزال المسائل المتعلقة بها قيد الإفصاح للجهات المُدارة المتأثرة.
متوفر أولًا لعدد قليل من المُختبرين
في اختبارات أكثر واقعية، بنى Astra سلسلة اختراق كاملة باستخدام مجموعة من المتصفحات المعززة ومجموعة من أنظمة التشغيل المعززة. وصرحت OpenAI أن النموذج نجح في الهروب من صندوق الرمل للمتصفح وتنفيذ أوامر على المضيف فقط من خلال إقناع الهدف بفتح ملف HTML ضار. وفي اختبار آخر، ربط النموذج بين عيوب نظامية متعددة لتكوين مسار ارتفاع الصلاحيات، مما منح حسابات المستخدمين العاديين صلاحيات root في النهاية.
أعلنت OpenAI أن نسبة رفض Astra لمحاولات تجاوز أمان الشبكة في الاختبارات الداخلية بلغت 91.5٪، وهي أعلى من 59٪ لـ GPT-5.6 Sol. ستُقدَّم أقوى قدرات أمان الشبكة أولاً لعدد قليل من المُختبرين في مرحلة alpha، ثم سيتم التوسع تدريجيًا من خلال مشروع Daybreak Blue، مع التركيز الأساسي على أعمال الأمان الدفاعية.
معلومات إضافية: صدر هذا الإفصاح في نفس اليوم الذي أطلقت فيه Anthropic Fable 5.1 وMythos 5.1، حيث لا يزال Mythos 5.1 محدودًا فقط على المؤسسات المعتمدة في مجالات الأمن السيبراني وعلوم الحياة. لم تُعلن OpenAI بعد عن تاريخ الإطلاق الرسمي لـ Astra.
