ChainThink संदेश, 31 जुलाई, CNBC की रिपोर्ट के अनुसार, 30 जुलाई को Anthropic ने खुलासा किया कि उसका Claude AI मॉडल साइबर सुरक्षा मूल्यांकन के दौरान अनधिकृत रूप से वास्तविक इंटरनेट तक पहुँच गया और तीन अलग-अलग संगठनों के वास्तविक प्रणालियों में अनधिकृत प्रवेश किया।
संबंधित मॉडल में Opus 4.7, Mythos 5 और एक आंतरिक अनुसंधान परीक्षण मॉडल शामिल हैं। Anthropic के अनुसार, मॉडल ने अनऑथेंटिकेटेड एंडपॉइंट्स तक पहुंचने और कमजोर पासवर्ड का उपयोग करने जैसी मूलभूत विधियों के माध्यम से हमला किया।
घटना का कारण एंथ्रोपिक और तीसरे पक्ष के मूल्यांकन साझेदार इर्रेगुलर के बीच संचार की गलतफहमी थी, जिसमें मॉडल को बताया गया कि यह नेटवर्क एक्सेस वाले एक अनुकरण परिवेश में है, लेकिन वास्तव में यह इंटरनेट से जुड़ा हुआ था।
Anthropic ने बताया कि इस समीक्षा की शुरुआत OpenAI द्वारा पिछले सप्ताह उजागर किए गए Hugging Face हमले के समान घटना से हुई।
वर्तमान में कंपनी ने सभी साइबर सुरक्षा मूल्यांकनों को निलंबित कर दिया है और स्वतंत्र AI मूल्यांकन संस्था METR के साथ अतिरिक्त जांच शुरू की है।
