Penyelidik keselamatan siber telah menemui kelemahan ketara dalam model daripada Anthropic dan OpenAI, dengan kesannya kini mencapai peringkat tertinggi kerajaan AS.
Laporan dari FAR.AI menguji beberapa model terkini, termasuk Claude Opus 4.8 milik Anthropic, Fable 5, serta GPT 5.5 dan 5.6 milik OpenAI, dan mendapati bahawa model-model tersebut rentan terhadap serangan jailbreak yang direka untuk mengekstrak output yang benar-benar berbahaya, termasuk kod eksploitatif, maklumat senjata kimia, dan butiran senjata biologi.
Nombor-nombor itu menceritakan kisah yang memalukan
Model-model Anthropic dan OpenAI bukanlah yang berprestasi terburuk. Gelar itu dimiliki oleh model Grok xAI, yang mencatat 448 kesempatan kejayaan jailbreak automatik. Model Gemini Google berada di tempat kedua dengan 249 kesempatan. Model-model Claude, Fable, dan GPT menunjukkan ketahanan yang lebih besar terhadap jailbreak.
Pada Jun 2026, Jabatan Perdagangan menghadkan akses asing kepada model Fable 5 dan Mythos 5 Anthropic selepas teknik jailbreak dilaporkan muncul. Rumah Putih juga telah meminta kedua-dua OpenAI dan Anthropic untuk menangguhkan pelancaran beberapa model akan datang supaya kerajaan dapat menilai risiko keselamatan siber dengan secukupnya.
Pengeksploitasian yang berkaitan dengan China menambahkan kegentingan
Laporan menunjukkan bahawa entiti yang dikaitkan dengan China telah memanfaatkan model Anthropic untuk mengautomasi serangan siber terhadap lebih daripada 30 sasaran. Teknik ini melibatkan promp yang dirangka secara khusus untuk mengelakkan palang keselamatan yang sedia ada.
Kerajaan AS menyebut risiko keselamatan negara ini secara eksplisit, menunjuk kepada potensi model AI untuk menghasilkan eksploit perisian dan maklumat berkaitan senjata apabila pengawalnya gagal. Tindak balas Anthropic ialah menandakan kerentanan tersebut sebagai "sempit", mencadangkan ia mewakili kes tepi berbanding kegagalan sistemik.
Apakah yang bermaksud ini kepada pelabur dan pasaran AI
Kawalan eksport, penangguhan pelepasan yang diwajibkan, dan kritikan kerajaan awam mewakili persekitaran operasi yang secara asas berbeza bagi syarikat-syarikat AI terkini. Keselamatan menjadi syarat mutlak untuk dibenarkan melancarkan model, yang secara langsung menterjemah kepada kos operasi yang lebih tinggi, tempoh pembangunan yang lebih panjang, dan pasaran yang mungkin lebih kecil jika sesetengah model tidak boleh dijual secara antarabangsa.
Nombor pelanggaran keselamatan Grok yang jauh lebih buruk — 448 kes berbanding nombor yang lebih rendah untuk varian Claude dan GPT — menunjukkan bahawa xAI mungkin menghadapi halangan peraturan yang lebih berat. Gemini Google pada 249 kes berada di posisi tengah yang tidak selesa.
Model AI semakin diintegrasikan ke dalam sistem perdagangan, pemeriksaan kontrak pintar, dan infrastruktur DeFi. Model AI yang telah dijailbreak dan ditanamkan dalam peralatan kewangan mewakili vektor risiko sistemik yang boleh merambat melalui pasaran digital yang saling berkaitan dengan cara yang baru saja mula difahami oleh pengawas.
