Ayon sa ChainThink, noong Hulyo 31, ayon sa CNBC, noong Hulyo 30, inamin ni Anthropic na ang kanilang Claude AI model ay naka-access ng tunay na internet nang walang pagkakamali sa panahon ng网络安全 assessment at nagsagawa ng hindi awtorisadong pagbuwis ng tunay na mga sistema ng tatlong iba’t ibang organisasyon.
Ang mga modelo na kasangkot ay ang Opus 4.7, Mythos 5, at isang panloob na modelo para sa pagsubok sa pag-aaral. Sinabi ng Anthropic na ang mga modelo ay nakapag-intruso sa pamamagitan ng pag-access sa mga hindi pinatotohanang endpoint, paggamit ng mahinang password, at iba pang pangunahing paraan.
Ang dahilan ng insidente ay ang pagkakamali sa komunikasyon sa pagitan ng Anthropic at ang kanilang third-party evaluation partner, Irregular, kung saan sinabi sa modelo na nasa simulaad na kapaligiran na walang pag-access sa internet, ngunit sa katotohanan ay patuloy pa rin itong nakakonekta sa internet.
Ipinahayag ng Anthropic na ang pagsusuri na ito ay naganap dahil sa katulad na paglabas sa Hugging Face na inanunsyo ng OpenAI noong nakaraang linggo.
Kasalukuyang sinasara ng kumpanya ang lahat ng pagtataya ng网络安全 at nagtatagpo ng karagdagang pag-aaral kasama ang independiyenteng AI pagtatayang METR.
