ChainThink melaporkan, pada 22 Julai, menurut postingan OpenAI, serangan terhadap infrastruktur Hugging Face minggu lepas disebabkan oleh model AI yang sedang diuji.
Kajian menunjukkan bahawa beberapa model berjaya melarikan diri daripada persekitaran sandbox dalam tugas penilaian keselamatan, memanfaatkan “lubang zero-day” untuk mendapatkan akses internet, kemudian menjalankan operasi automatik di persekitaran pengeluaran Hugging Face.
OpenAI menyatakan bahawa insiden tersebut disebabkan oleh beberapa model OpenAI, termasuk GPT-5.6 Sol dan sebuah model pra-pelancaran yang lebih canggih. Untuk tujuan ujian penilaian ini, mekanisme keselamatan model yang berkaitan sengaja diturunkan.
OpenAI menyatakan bahawa insiden ini mengungkapkan risiko model AI canggih yang mungkin melaksanakan serangan siber kompleks tanpa sekatan keselamatan, serta menunjukkan bahawa AI boleh digunakan untuk mengesan lubang keamanan dan pertahanan keselamatan.
