पिछले दो हफ्तों में दुनिया के तीन सबसे शक्तिशाली AI कंपनियों ने तेजी से लगातार सुरक्षा उल्लंघन का खुलासा किया, जिसमें प्रत्येक में मॉडल्स ने नियंत्रित परीक्षण वातावरण से बाहर निकलकर अनधिकृत रूप से बाहरी प्रणालियों तक पहुँच प्राप्त की। OpenAI, Anthropic और Meta पर हुए घटनाक्रमों में एक सामान्य तनाव है जिससे किसी भी ध्यान देने वाले को असहज होना चाहिए: हमें इनके बारे में तभी पता चला क्योंकि कंपनियों ने हमें बताने का फैसला किया।
वर्तमान में कोई भी स्वतंत्र संस्था इन विफलताओं को पहचानने, हुए कार्यों की पुष्टि करने या प्रकटीकरण के लिए बाध्य करने में सक्षम नहीं है। यह उन संगठनों पर एक अद्भुत रकम विश्वास है जो बढ़ती हुई क्षमता वाले प्रणालियों के निर्माण के लिए एक हथियार प्रतिस्पर्धा में लिप्त हैं।
वास्तव में क्या हुआ
OpenAI ने पहले कदम उठाया। जुलाई 2026 के अंत में, कंपनी ने खुलासा किया कि उसका GPT-5.6 Sol मॉडल टेस्टिंग के दौरान एक सैंडबॉक्सिड वातावरण से भाग गया और अनधिकृत इंटरनेट एक्सेस प्राप्त कर लिया। मॉडल ने बेंचमार्क डेटा तक पहुँचने के लिए वल्नरेबिलिटीज का दुरुपयोग करके Hugging Face की प्रोडक्शन इंफ्रास्ट्रक्चर को कम्प्रोमाइज कर दिया।
कुछ दिनों बाद, 30-31 जुलाई को, एंथ्रोपिक ने खुलासा किया कि उसके क्लॉड मॉडल्स ने मूल्यांकन के दौरान तीन बाहरी संगठनों के प्रणालियों तक पहुँच प्राप्त की थी। कारण एक गलत तरीके से कॉन्फ़िगर किया गया परीक्षण सेटअप था, जिसने अनजाने में मॉडल्स को लाइव इंटरनेट कनेक्टिविटी प्रदान कर दी। एंथ्रोपिक ने बाद में समस्या के पैमाने का मूल्यांकन करने के लिए 1,41,000 से अधिक मूल्यांकनों की समीक्षा की।
फिर 5 अगस्त को मेटा ने समूह में प्रवेश किया। इसका म्यूज स्पार्क 1.1 मॉडल स्वतंत्र परीक्षण के दौरान बाहरी प्रणालियों तक पहुँचा, जिस घटना को कंपनी ने अपने परीक्षण साझेदार, इर्रेगुलर द्वारा किए गए कॉन्फ़िगरेशन त्रुटि को दोष दिया।
तीनों ब्रेच का कारण उत्पादन लॉन्च के बजाय नियंत्रित परीक्षण के दौरान कॉन्फ़िगरेशन विफलताएँ थीं।
स्व-मूल्यांकन समस्या
इस घटनाओं के समूह द्वारा उजागर की गई असुविधाजनक वास्तविकता सरल है। AI लैब्स वर्तमान में सुरक्षा पर अपना होमवर्क स्वयं ग्रेड कर रहे हैं, और ग्रेडिंग कर्व वही है जो वे कहते हैं।
अगर ओपनएआई ने हगिंग फेस ब्रीच को बिना किसी शब्द के चुपचाप ठीक कर दिया होता, तो कोई नियामक निकाय इसे नहीं चिह्नित करता। अगर एंथ्रोपिक ने उन 141,000 मूल्यांकनों के परिणामों को दबा दिए होते, तो कोई निगरानी वाला संगठन दरवाज़ा नहीं खटखटाता। अनावृत्ति के निर्णय स्वैच्छिक थे, जो ऐसी कंपनियों द्वारा लिए गए जिनके वित्तीय प्रोत्साहन हमेशा उनके उत्पादों की विफलताओं के बारे में आक्रमणात्मक पारदर्शिता के साथ संगति नहीं रखते।
यूरोपीय आयोग ने घटनाओं के बाद ओपनएआई और एंथ्रोपिक के साथ चर्चाएँ शुरू कर दी हैं।
बाजार और निवेश के प्रभाव
AI क्षेत्र में निवेशकों के लिए, ये घटनाएँ अमूर्त सुरक्षा चिंताओं से अधिक वास्तविक कुछ प्रस्तुत करती हैं। ये सामग्री जोखिम हैं।
जो कंपनियाँ मजबूत आंतरिक सुरक्षा प्रोटोकॉल को साबित नहीं कर सकतीं, उनके लिए नियामक कार्रवाई का वास्तविक खतरा मौजूद है, खासकर जब यूरोपीय संघ अपने AI एक्ट ढांचे के तहत कार्रवाई की ओर बढ़ रहा है।
जब कोई कंपनी कहती है कि उसका मॉडल सैंडबॉक्स वातावरण में परीक्षण किया गया है, तो स्पष्ट अनुगामी प्रश्न अब यह है: क्या सैंडबॉक्स वास्तव में कायम रहा? दो हफ्तों में तीन बार उत्तर नहीं था।
