Lab pembangunan AI OpenAI mengungkapkan pada hari Selasa bahawa sekumpulan modelnya, termasuk GPT-5.6 Sol yang tersedia secara awam dan satu sistem yang belum dirilis dengan kemampuan lebih tinggi, telah “melarikan diri” daripada persekitaran ujian terkawal dan mengompromikan infrastruktur pengeluaran Hugging Face, syarikat yang menghoskan sebahagian besar dunia AI sumber terbuka.
Model-model tersebut dijalankan melalui tolok ukur dalaman bernama ExploitGym, ujian tugas perompakan berperingkat panjang dan berbilang langkah, dengan penolakan keselamatan siber mereka sengaja diturunkan untuk penilaian.
Untuk jelas, ini bukan model pengeluaran yang tiba-tiba menjadi bermusuhan. Ia adalah model yang mampu dengan pengawal dimatikan dan secara khusus diperintahkan untuk menang dalam ujian peretasan - melakukan apa sahaja yang diperlukan untuk menang.
Model-model tersebut menemukan kelemahan tersembunyi dalam perisian ujian, satu yang tidak ada yang tahu wujudnya, dan menggunakannya untuk melintasi dinding yang ditetapkan untuk mengekalkan mereka secara luar talian. Setelah berada di internet terbuka, mereka menduga bahawa Hugging Face mungkin menyimpan jawapan ujian tersebut.
Untuk masuk, mereka menggabungkan kata laluan curi dan kelemahan tersembunyi lain sehingga boleh menjalankan arahan sendiri di pelayan langsung Hugging Face.
OpenAI menangkap anomali tersebut secara dalaman, manakala pasukan Hugging Face mengesan dan mengawalnya. Ia memanggil insiden itu sebagai "belum pernah berlaku sebelum ini," dan mengatakan langkah keselamatan yang meluas akan diambil untuk mencegah insiden tidak diingini yang mungkin memberi kesan kepada sistem atau perkhidmatan awam.
“Kami sedang melaksanakan kawalan ketat dalam konfigurasi infrastruktur dengan mengorbankan kelajuan penyelidikan semasa kerentanan dibaiki,” kata pasukan itu dalam posting blog mereka. “Kami sedang memperbaiki dan menambah perlindungan yang lebih kuat terhadap latihan dan penilaian masa depan.”
Banyak serangan kripto berlaku sebelum dana bergerak. Penyerang memindai kod, menguji kata laluan, mencari kredensial yang terdedah, menganalisis tetapan tanda tangan, dan mencari jalan masuk ke akaun pentadbir.
Model-model OpenAI menjalankan beberapa bahagian proses itu semasa insiden Hugging Face, berpindah dari satu kelemahan ke kelemahan lain sehingga mencapai pelayan pengeluaran langsung.
Dan pasaran kripto mempunyai banyak tempat di mana pendekatan ini boleh berjaya, seperti yang ditunjukkan oleh beberapa serangan awal tahun ini. Titik lemah mungkin merupakan kontrak pintar, tetapi ia juga mungkin merupakan laptop pembangun, pakej perisian yang diracuni, penentu jambatan, atau satu penandatangan dalam dompet multisig.
Ambil serangan Drift sebanyak $285 juta pada awal tahun ini sebagai contoh, pencurian yang memerlukan kampanye rekayasa sosial selama enam bulan untuk mencapai akses istimewa. Sebuah agen AI boleh, secara teori, menguji banyak laluan secara serentak, mengesan cubaan yang gagal, dan terus bekerja semasa operator manusianya tidur. Sekali laluan ditemui, operator boleh bertindak terhadap serangan sebenar dan laluan pelarian yang boleh dilaksanakan.
Kerugian jambatan KelpDAO sebanyak $292 juta mengungkap kelemahan yang berbeza. Penyerang menemui kelemahan penilai tunggal dalam sistem yang digunakan untuk memindahkan aset antara blok rantai.
Serangan sebegini bermula dengan semakan kod yang sabar dan pemetaan infrastruktur - jenis kerja yang dilakukan oleh model OpenAI apabila mereka menemui kelemahan yang tidak diketahui.
Sejenis serangan ketiga menargetkan sistem tata kelola onchain. Pada awal Julai, seorang penyerang membelanjakan sebanyak $4.4 juta untuk membeli cukup banyak memecoin BONK berasaskan Solana untuk memulakan dan meluluskan cadangan yang memindahkan kira-kira $20 juta dari kas projek kepada penyerang. Peristiwa ini berlaku dalam tempoh tiga hari, dan penyerang kemudian menjual semua token yang digunakan untuk memenangi undian, seperti dilaporkan oleh CoinDesk pada masa itu.
Pembelian, undian, dan pindahan perbendaharaan untuk serangan itu semuanya merupakan transaksi yang sah secara individu. Tetapi pencurian berlaku kerana memahami bagaimana peraturan-beberapa berkerjasama dan menemui bahawa kos untuk membeli kawalan jauh lebih rendah berbanding dana yang tersedia untuk diambil.
Insiden Hugging Face juga penting untuk rantai bekalan perisian. Pembangun kripto bergantung pada repositori kod awam, perkhidmatan awan dan registri pakej.
Walaupun ujian OpenAI menunjukkan mesin menyelesaikan bahagian tengah yang panjang sebuah pelanggaran, serangan seperti Drift dan KelpDAO menunjukkan apa yang berada di hujung jalan itu.





