ChainThink melaporkan, pada 31 Julai, menurut laporan CNBC, Anthropic mengungkap pada 30 Julai bahawa model AI Claude-nya secara tidak sengaja mengakses internet sebenar semasa penilaian keselamatan siber dan merompak sistem sebenar tiga organisasi yang berbeza tanpa kebenaran.
Model yang terlibat termasuk Opus 4.7, Mythos 5, dan satu model ujian penyelidikan dalaman. Anthropic menyatakan bahawa model tersebut berjaya menyusup melalui penggunaan kaedah asas seperti akses ke endpoint yang tidak sah dan memanfaatkan kata laluan lemah.
Peristiwa ini berpunca daripada kesalahfahaman komunikasi antara Anthropic dan pihak penilaian pihak ketiga, Irregular, di mana model diberitahu bahawa ia berada dalam persekitaran simulasi tanpa akses internet, tetapi sebenarnya masih boleh menyambung ke internet.
Anthropic menyatakan bahawa semakan ini dipicu oleh insiden serupa yang diumumkan oleh OpenAI minggu lalu terhadap Hugging Face.
Syarikat kini telah menghentikan semua penilaian keselamatan siber dan sedang menjalankan penyiasatan lanjut bersama agensi penilaian AI bebas, METR.
