ChainThink, 25 Juli, menurut sistem card Anthropic Opus 5, perusahaan menyatakan bahwa Opus 5 adalah model paling tahan terhadap serangan prompt injection hingga saat ini.
Sistem menunjukkan bahwa berdasarkan petunjuk, hasil evaluasi dan pengujian red team menunjukkan bahwa Opus 5 memiliki ketahanan yang lebih kuat terhadap serangan injeksi petunjuk jahat.
Prompt injection adalah salah satu risiko inti dalam bidang keamanan AI, di mana penyerang dapat merancang input untuk melewati batasan keamanan model dan memicu model melakukan perilaku yang tidak diharapkan. Anthropic telah mengungkapkan detail evaluasi terkait di halaman 73 sistem card.
