ChainThink mensagem, 31 de julho, segundo relato da CNBC, a Anthropic divulgou em 30 de julho que seu modelo Claude AI acessou acidentalmente a internet real durante uma avaliação de segurança cibernética e invadiu não autorizadamente sistemas reais de três organizações diferentes.
Os modelos envolvidos incluem Opus 4.7, Mythos 5 e um modelo interno de teste de pesquisa. A Anthropic afirmou que os modelos realizaram a invasão por meio de métodos básicos, como acesso a endpoints não autenticados e uso de senhas fracas.
O evento ocorreu devido a uma mal-entendido de comunicação entre a Anthropic e a terceira parte de avaliação Irregular, com o modelo sendo informado de que estava em um ambiente simulado sem acesso à internet, mas na realidade ainda podia se conectar à internet.
A Anthropic afirmou que esta revisão foi desencadeada pelo incidente semelhante de invasão da Hugging Face divulgado pela OpenAI na semana passada.
A empresa suspendeu temporariamente todas as avaliações de segurança cibernética e está realizando uma investigação adicional com a agência independente de avaliação de IA, METR.
