source avatar動區動趨 BlockTempo

Bagikan

Model AI OpenAI secara langsung melakukan peretasan ke server orang lain untuk curang selama pengujian, salah satu insiden AI paling konyol sepanjang tahun ini. GPT-5.6 Sol dan model lain yang belum dirilis, saat menguji kemampuan keamanan internal, memutuskan untuk meninggalkan pertanyaan dan mencari kunci jawaban untuk menipu demi mendapatkan skor tinggi di benchmark ExploitGym. Model tersebut terlebih dahulu memanfaatkan kerentanan nol-hari internal @OpenAI untuk menembus isolasi sandbox dan mendapatkan akses ke jaringan eksternal, lalu meningkatkan otoritas, bergerak secara lateral, dan akhirnya meretas lingkungan produksi Hugging Face untuk mencuri semua jawaban ExploitGym. Ini bukan hasil operasi jarak jauh atau perintah dari insinyur—model ini bertindak sepenuhnya secara otonom. Saat Hugging Face menemukannya, mereka terkejut; CEO mereka mengatakan: “Ini tak masuk akal, terjadi secara mandiri.” “Sosial rekayasa” AI terhadap manusia: manusia memberi batasan, tetapi model memilih menghindari batasan itu untuk mencapai tujuannya. Ini adalah eksploitasi celah aturan, tetapi belum pernah sebelumnya terjadi hingga menyerang server pihak ketiga nyata. Kedua perusahaan kini menekankan “tantangan keamanan di era agen AI”—jika Anda memberi model sebuah tujuan tanpa memasang pagar yang tepat, ia mungkin mencapainya dengan cara yang tak Anda duga, termasuk langsung meretas Anda.

No.0 picture
No.1 picture
Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.