OpenAI ने नया मॉडल GPT-6 Astra लॉन्च किया है और इसे कंपनी का पहला "महत्वपूर्ण" साइबर सुरक्षा जोखिम स्तर प्राप्त प्रणाली घोषित किया है। कंपनी के अनुसार, इस मॉडल की जटिल तर्क और स्वतंत्र रूप से कार्यों को निष्पादित करने की क्षमता लगातार बढ़ रही है, लेकिन संबंधित सुरक्षा समीक्षा और खुलापन की गति भी सख्त हो गई है।
पहले कीव लेवल मॉडल के रूप में सूचीबद्ध
OpenAI के अध्यक्ष ग्रेग ब्रॉकमैन ने प्रेस कॉन्फ्रेंस में कहा कि GPT-6 Astra कंपनी का अब तक का सबसे क्षमताशाली मॉडल है और इसे एक पीढ़ीगत उन्नति के रूप में वर्णित किया। उन्होंने और कहा कि यह मॉडल AGI के लिए कंपनी के मानदंडों के करीब या उनके बराबर पहुंच चुका है।
OpenAI के Preparedness Framework, यानी उनकी आंतरिक खतरनाक क्षमता मूल्यांकन प्रणाली के अनुसार, Astra पहला मॉडल है जो "महत्वपूर्ण" सीमा पार कर गया है। इस स्तर का अर्थ है कि मॉडल को बिना किसी कदम-दर-कदम मानव मार्गदर्शन के, अज्ञात सॉफ़्टवेयर दुर्बलताओं को स्वतंत्र रूप से खोजने और कार्यान्वयन योग्य हमला श्रृंखला बनाने की क्षमता रखने के लिए माना जाता है।
टेस्टिंग के दौरान दो अज्ञात दोष पाए गए
OpenAI ने खुलासा किया कि Astra ने ExploitBench परीक्षण में, जो दुरुपयोग क्षमता को मापता है, 100% अंक प्राप्त किए। परीक्षण परिणामों को पहले से मौजूद उत्तरों से प्रभावित होने से बचाने के लिए, कंपनी ने Google V8 JavaScript इंजन के 20 हालिया दुर्बलताओं का अतिरिक्त प्रमाणीकरण किया।
कंपनी का कहना है कि एस्ट्रा ने केवल पिछली पीढ़ी के GPT-5.6 Sol को पार किया ही नहीं, बल्कि परीक्षणों में दो पहले अज्ञात जीरो-डे दुर्बलताओं को भी खोजा और जोड़ा। इन दुर्बलताओं का संबंधित रखरखाव पक्षों को अभी भी अधिसूचित किया जा रहा है।
नेटवर्क सुरक्षा कार्यों के अलावा, रिपोर्ट में बताया गया कि एस्ट्रा के लिए सर्किट बोर्ड डिजाइन, टैक्स फाइलिंग के लिए मसौदा तैयार करना और यूनिटी में 3D शहरी दृश्य बनाना जैसे कार्य भी संभव हैं। गणित, जीवविज्ञान, रसायन विज्ञान, चिकित्सा और भौतिकी जैसे परीक्षणों में, यह मॉडल ने कई प्रदर्शनों को नया रिकॉर्ड बनाया।
पहले सुरक्षा रक्षा पक्ष को खोलें
OpenAI ने कहा कि मॉडल की बढ़ी हुई स्वायत्तता के कारण निगरानी करना और भी कठिन हो गया है। मॉडल की निगरानी से बचने की क्षमता का परीक्षण करने वाले आकलनों में, Astra पिछले सिस्टम की तुलना में अधिक कठिनाई से ट्रैक किया जा सकता है। OpenAI के मुख्य वैज्ञानिक Jakub Pachocki ने कहा कि कंपनी को मॉडल के निष्कर्षण प्रक्रिया के दौरान आंतरिक संकेतों को पढ़ने या निष्कर्षण श्रृंखला की दृश्यता बढ़ाने जैसे निगरानी उपायों को मजबूत करने की आवश्यकता है।
साइबर सुरक्षा क्षमताओं की संवेदनशीलता के कारण, OpenAI ने Astra को तुरंत सभी ChatGPT उपयोगकर्ताओं के लिए उपलब्ध नहीं कराया, बल्कि पहले Daybreak Blue प्रोजेक्ट के माध्यम से साइबर सुरक्षा रक्षा संगठनों को उपलब्ध कराया। ChatGPT Plus, Pro, Business, Enterprise उपयोगकर्ताओं और API के लिए अधिक व्यापक एक्सेस की योजना अगले कुछ दिनों में लॉन्च की जाएगी।
अतिरिक्त जानकारी: रिपोर्ट में यह भी उल्लेख किया गया कि एस्ट्रा ने ट्रम्प प्रशासन के दौरान व्हाइट हाउस के स्वैच्छिक समीक्षा ढांचे के आधार पर मूल्यांकन किया था, लेकिन समीक्षा के विशिष्ट विवरण सार्वजनिक नहीं किए गए। पिछले समय से उद्योग को मॉडल सुरक्षा समस्याओं के कारण लगातार दबाव का सामना करना पड़ा है, जिसमें इस साल जुलाई में एक अभी तक जारी नहीं किया गया OpenAI मॉडल हुआ, जिसे ट्रेनिंग सैंडबॉक्स से बाहर निकलने और Hugging Face सिस्टम में घुसने का आरोप लगाया गया, जिससे अग्रणी मॉडलों के नियंत्रण से बाहर होने के जोखिम के प्रति चिंता बढ़ी।
