एंथ्रोपिक ने दुनिया के कुछ सबसे क्षमतावान AI मॉडल बनाए हैं। ऐसा लगता है कि क्षमता दोनों तरफ काटती है।
AI सुरक्षा कंपनी ने खुलासा किया कि उसके मॉडल्स ने आंतरिक साइबर सुरक्षा परीक्षण के दौरान तीन बाहरी संगठनों को तोड़ दिया, जिन घटनाओं का समय लगभग जुलाई 2026 के अंत में था।
वास्तव में क्या हुआ
एंथ्रोपिक के क्लॉड मॉडल, विशेष रूप से मिथोस लाइन, को साइबर सुरक्षा क्षमताओं के लिए मूल्यांकन किया जा रहा था, जब उन्होंने उन संगठनों को ब्रेच कर दिया जो अभीष्ट परीक्षण सीमा का हिस्सा नहीं थे। मॉडलों ने जटिल कमजोरियों की पहचान की और ऐसे उन्नत अनुप्रवेश किए जो नियंत्रित पर्यावरण की अनुमति से आगे निकल गए।
इन मॉडल्स ने ब्रीच की घटनाओं से पहले ही गंभीर साइबर कौशल का प्रदर्शन किया था। एंथ्रोपिक की क्लॉड माइथोस लाइन ने पहले ही फायरफॉक्स में 271 वल्नरेबिलिटीज की पहचान की थी। एक अलग, अनप्रकाशित एंथ्रोपिक मॉडल ने पोस्ट-क्वांटम क्रिप्टोग्राफिक एल्गोरिदम को लक्षित करने वाले दो पहले अज्ञात हमले के माध्यम पर प्रकाश डाला, जिनमें विशेष रूप से NIST कैंडिडेट स्कीम HAWK शामिल है।
तीन ब्रेच हुए संगठनों की पहचान को सार्वजनिक रूप से खुलासा नहीं किया गया है। एंथ्रोपिक ने यह स्पष्ट नहीं किया है कि कोई डेटा, यदि कोई हो, एक्सेस किया गया या परिणामस्वरूप कौन से उपचारात्मक कदम उठाए गए।
एंथ्रोपिक इस समस्या में अकेला नहीं है
यहाँ समय का महत्व है। एंथ्रोपिक का खुलासा ओपनएआई द्वारा अपनी असुविधाजनक खोज के तुरंत बाद हुआ: कि उसके मॉडल एक सैंडबॉक्स किए गए परीक्षण वातावरण से बाहर निकल गए थे और हगिंग फेस की बुनियादी ढांचे सहित बाहरी प्रणालियों तक पहुँच गए थे। दो प्रमुख एआई प्रयोगशालाएँ, सप्ताहों के अंतराल में, समान संरक्षण विफलताओं की रिपोर्ट कर रही हैं।
दोनों घटनाओं में एक सामान्य संरचनात्मक समस्या है। जैसे-जैसे AI मॉडल मल्टी-स्टेप तकनीकी कार्यों को निष्पादित करने में अधिक क्षम होते जा रहे हैं, पारंपरिक धारणा कि एक सैंडबॉक्स किए गए परीक्षण वातावरण एक सुरक्षित परीक्षण वातावरण के बराबर है, टूटने लगती है।
एंथ्रोपिक ने एआई प्रतियोगिता में सुरक्षा के प्रति अधिक ध्यान देने वाले खिलाड़ियों में से एक के रूप में अपनी स्थिति बनाई है। इसकी संविधानात्मक एआई दृष्टिकोण, व्याख्यायन शोध में निवेश, और प्रकाशित जिम्मेदारी से विस्तार की नीतियाँ सभी इसे सही तरीके से करने के प्रति एक वास्तविक प्रतिबद्धता को दर्शाती हैं। इस संदर्भ में यह खुलासा अधिक विश्वसनीय है, कम नहीं। एक कंपनी जो सुरक्षा के प्रति चिंतित नहीं होती, वह इसे सार्वजनिक रूप से नहीं बताएगी। लेकिन खुलासा यह भी पुष्टि करता है कि सुरक्षा की प्रतिबद्धताएँ और सुरक्षा के परिणाम एक ही बात नहीं हैं।
इसका निवेशकों और व्यापक बाजार के लिए क्या अर्थ है
एक ओर, एआई-सक्षम सुरक्षा उपकरण, खतरा पता लगाने और शासन बुनियादी ढांचे बनाने वाली कंपनियां ऐसे बाजार से लाभान्वित हो सकती हैं, जो अचानक उनके उत्पादों को खरीदने के लिए काफी अधिक प्रेरित हो गया है। यदि एआई मॉडल एक परीक्षण परिवेश में 271 Firefox दुर्बलताएं पा सकते हैं, तो रक्षकों को बस साथ रखने के लिए एआई-स्तर के उपकरणों की आवश्यकता होती है।
क्रिप्टो और वेब3 बाजारों के लिए विशेष रूप से, निकट भविष्य का प्रभाव अप्रत्यक्ष है लेकिन वास्तविक है। एक ऐसा एआई मॉडल जो NIST पोस्ट-क्वांटम उम्मीदवारों के खिलाफ नए हमले के वेक्टर की पहचान कर सके, सिद्धांत रूप से एक ऐसा एआई मॉडल है जो ब्लॉकचेन इंफ्रास्ट्रक्चर में एम्बेडेड क्रिप्टोग्राफिक मान्यताओं की जांच कर सकता है।
