OpenAI ने 1 सितंबर को कहा कि अभी तक जारी नहीं किया गया Astra, कंपनी के "तैयारी ढांचे" में "क्रिटिकल लेवल" साइबर सुरक्षा सीमा को पार कर चुका है। यह OpenAI की ओर से पहली बार है जब किसी मॉडल को इस श्रेणी में शामिल किया गया है, जिसका अर्थ है कि इसके विकास और प्रकाशन से पहले इस पर अधिक कठोर सुरक्षा प्रतिबंध लागू होंगे।
First-time entry to Key Level
OpenAI के परिभाषा के अनुसार, यदि मॉडल कई सुदृढीकृत वास्तविक प्रणालियों में अज्ञात दुर्बलताओं को स्वतंत्र रूप से खोज सकता है और कार्यात्मक हमला श्रृंखला बना सकता है, या केवल उच्च स्तरीय लक्ष्य के आधार पर कठिन लक्ष्यों के खिलाफ पूर्ण नेटवर्क हमला पूरा कर सकता है, तो इसे "क्रिटिकल" स्तर पर वर्गीकृत किया जाएगा। पहले GPT-5.6 Sol सहित मॉडल सबसे अधिक "उच्च जोखिम" श्रेणी तक ही सीमित थे।
टेस्टिंग के दौरान दो जीरो-डे वल्नरेबिलिटीज पाई गईं
ExploitBench में, Astra की पास रेट 100% है। यह परीक्षण मुख्य रूप से मॉडल की क्षमता का परीक्षण करता है कि वह ज्ञात सॉफ़्टवेयर दुर्बलताओं को निष्पादनयोग्य दुरुपयोग कोड में बदल सकता है या नहीं।
मेमोरी क्वेश्चन बैंक के प्रभाव को दूर करने के लिए, OpenAI ने इस साल जून से अगस्त के बीच जारी 20 Google V8 JavaScript इंजन के हाई-रिस्क वल्नरेबिलिटीज का आंतरिक परीक्षण किया। OpenAI के अनुसार, Astra ने किसी भी कोड के निष्पादन की सफलता दर में GPT-5.6 Sol को पार कर लिया है और इसके लिए कम आउटपुट टोकन का उपयोग किया गया है। परीक्षण के दौरान, Astra ने दो पहले अज्ञात जीरो-डे वल्नरेबिलिटीज को स्वयं खोजा और उन्हें जोड़ा, और संबंधित मुद्दों को प्रभावित मेंटेनर्स को अभी भी अलर्ट किया जा रहा है।
पहले कुछ परीक्षण उपयोगकर्ताओं के लिए खोलें
एक अधिक वास्तविक परीक्षण में, एस्ट्रा ने एक सुदृढीकृत ब्राउज़र और एक सुदृढीकृत ऑपरेटिंग सिस्टम के सेट पर पूर्ण आक्रमण श्रृंखला बनाई। ओपनएआई के अनुसार, मॉडल ने केवल लक्ष्य को दुर्भावनापूर्ण HTML फ़ाइल खोलने के लिए प्रेरित करके ब्राउज़र सैंडबॉक्स से भागना और होस्ट मशीन पर कमांड निष्पादित करना पूरा किया। एक अन्य परीक्षण में, इसने कई सिस्टम दोषों को एक साथ जोड़कर एक प्रवेश पथ बनाया, जिससे सामान्य उपयोगकर्ता खाते को अंततः root अधिकार प्राप्त हुए।
OpenAI ने कहा कि आंतरिक परीक्षणों में Astra ने साइबर सुरक्षा जेल ब्रेक प्रॉम्प्ट्स को 91.5% की दर से अस्वीकार किया, जो GPT-5.6 Sol के 59% से अधिक है। इसकी सबसे मजबूत साइबर सुरक्षा क्षमता पहले कुछ alpha टेस्टर्स को उपलब्ध कराई जाएगी, और फिर Daybreak Blue प्रोजेक्ट के माध्यम से धीरे-धीरे विस्तारित की जाएगी, जो मुख्य रूप से रक्षात्मक सुरक्षा कार्यों के लिए है।
अतिरिक्त जानकारी: इस उद्घोषणा के समय, Anthropic ने एक ही दिन Fable 5.1 और Mythos 5.1 लॉन्च किए हैं, जिसमें Mythos 5.1 अभी भी सत्यापित साइबर सुरक्षा और जीव विज्ञान संस्थानों के लिए ही उपलब्ध है। OpenAI अभी तक Astra की आधिकारिक लॉन्च तारीख की घोषणा नहीं कर चुका है।
