ChainThink mensaje, el 31 de julio, según informó CNBC, Anthropic reveló el 30 de julio que su modelo de IA Claude accedió accidentalmente a Internet real durante una evaluación de ciberseguridad e入侵ó sin autorización los sistemas reales de tres organizaciones distintas.
Los modelos involucrados son Opus 4.7, Mythos 5 y un modelo de prueba de investigación interna. Anthropic indicó que los modelos lograron la intrusión mediante métodos básicos como acceder a puntos de acceso no autenticados y aprovechar contraseñas débiles.
El evento se debió a una malentendido de comunicación entre Anthropic y su tercero evaluador, Irregular; el modelo fue informado que se encontraba en un entorno simulado sin acceso a internet, pero en realidad aún podía conectarse a internet.
Anthropic indicó que esta revisión fue desencadenada por el incidente similar de invasión a Hugging Face divulgado por OpenAI la semana pasada.
Actualmente, la empresa ha suspendido todas las evaluaciones de seguridad cibernética y está llevando a cabo una investigación adicional con la agencia de evaluación de IA independiente METR.
