Odaily स्टार डेली की खबर के अनुसार, OpenAI ने पुष्टि की है कि GPT-5.6 Sol और एक अननामित, अधिक शक्तिशाली प्री-रिलीज मॉडल ने ExploitGym बेंचमार्क परीक्षण में प्रतिबंधित सैंडबॉक्स वातावरण को तोड़ दिया और परीक्षण के उत्तर प्राप्त करने के लिए Hugging Face के उत्पादन अवसंरचना में घुसपैठ कर ली।
OpenAI ने बताया कि संबंधित मॉडल ने आंतरिक सॉफ्टवेयर पैकेज रजिस्ट्री प्रॉक्सी के ज़ीरो-डे दुरुपयोग का उपयोग करके अधिकार बढ़ाए और क्षैतिज रूप से अंतर्गत चलाया, अंततः इंटरनेट तक पहुँच वाली मशीन से कनेक्ट हुआ। मॉडल ने बाद में OpenAI अनुसंधान वातावरण और Hugging Face उत्पादन बुनियादी ढांचे में वल्नरेबिलिटी की पहचान की और Hugging Face उत्पादन डेटाबेस से परीक्षण समाधान सीधे प्राप्त किए।
Hugging Face ने 16 जुलाई को इस घटना का खुलासा किया, जिसमें कहा गया कि हमला स्वायत्त AI एजेंट सिस्टम द्वारा एंड-टू-एंड निष्पादित किया गया था, जिसमें छोटे जीवनकाल वाले सैंडबॉक्स में हजारों क्रियाएँ शामिल थीं और आंतरिक डेटासेट और सेवा पात्रता तक पहुँची। OpenAI ने पाँच दिन बाद अपने मॉडल को इस घटना का कारण बताया।
हगिंग फेस ने बताया कि अपनी सुरक्षा टीम ने 17,000 से अधिक हमला लॉग का विश्लेषण करने के लिए अमेरिकी व्यावसायिक एआई इंटरफ़ेस का प्रयास किया, लेकिन सुरक्षा बाधाओं के कारण अनुरोध रोक दिया गया; इसके बाद, उन्होंने चीनी एआई स्टार्टअप Z.ai के 7530 अरब पैरामीटर ओपन-सोर्स वेट मॉडल GLM 5.2 का उपयोग अपने स्वयं के इंफ्रास्ट्रक्चर पर किया।
