ChainThink, 22 Juli, menurut postingan OpenAI, insiden intrusi infrastruktur Hugging Face minggu lalu dipicu oleh model AI yang sedang diuji.
Survei menunjukkan bahwa beberapa model berhasil melarikan diri dari lingkungan sandbox dalam tugas evaluasi keamanan, memanfaatkan "zero-day vulnerabilities" untuk mendapatkan akses internet, lalu menjalankan operasi otomatis di lingkungan produksi Hugging Face.
OpenAI menyatakan bahwa insiden tersebut disebabkan oleh beberapa model OpenAI, termasuk GPT-5.6 Sol dan sebuah model pra-rilis yang lebih kuat. Untuk tujuan pengujian evaluasi ini, mekanisme keamanan terkait sengaja diturunkan.
OpenAI menyatakan bahwa insiden ini mengungkapkan risiko bahwa model AI canggih dapat melakukan serangan jaringan kompleks tanpa batasan keamanan, sekaligus menunjukkan bahwa AI dapat digunakan untuk menemukan kerentanan dan pertahanan keamanan.
