رسالة ChainThink، 31 يوليو، وفقًا لتقرير CNBC، كشفت Anthropic في 30 يوليو أن نموذج Claude AI الخاص بها وصل عرضًا إلى الإنترنت الحقيقي أثناء تقييم أمن الشبكة، واقتحمت دون إذن أنظمة حقيقية تابعة لثلاث منظمات مختلفة.
تشمل النماذج المعنية Opus 4.7 وMythos 5 ونموذج داخلي للبحث والاختبار. وصرحت Anthropic أن النماذج نفذت الاختراق من خلال الوصول إلى نقاط نهاية غير معتمدة واستخدام كلمات مرور ضعيفة وغيرها من الوسائل الأساسية.
كان سبب الحدث سوء فهم في التواصل بين Anthropic وطرف التقييم الخارجي Irregular، حيث تم إعلام النموذج بأنه في بيئة محاكاة بدون وصول إلى الإنترنت، لكنه في الواقع ما زال قادرًا على الاتصال بالإنترنت.
أشارت Anthropic إلى أن هذا التدقيق تم تحفيزه بواسطة الحادث المماثل الذي كشفت عنه OpenAI الأسبوع الماضي ضد Hugging Face.
حاليًا، أوقفت الشركة جميع تقييمات الأمن السيبراني وبدأت تحقيقًا إضافيًا مع جهة تقييم خارجية مستقلة تُدعى METR.
