رسالة من ChainThink، 25 يوليو، وفقًا لبطاقة نظام Anthropic Opus 5، أفادت الشركة أن Opus 5 هو أقوى نموذج لديها حتى الآن ضد هجمات حقن التوجيه.
يُظهر نظام العرض أن Opus 5 يمتلك قدرة أكبر على مقاومة حقن التعليمات البرمجية الضارة بناءً على نتائج التقييم واختبارات فريق الأحمر.
إن حقن التلميح هو أحد المخاطر الأساسية في مجال أمان الذكاء الاصطناعي، حيث يمكن للمهاجمين تجاوز قيود الأمان للنموذج من خلال تصميم مدخلات، مما يحفز النموذج على تنفيذ سلوكيات غير متوقعة. كشفت Anthropic عن تفاصيل التقييم ذات الصلة في الصفحة 73 من بطاقة النظام.
