Claude Opus 5 résiste aux attaques d'injection de prompts dans les scénarios de navigateur

iconKuCoinFlash
Partager
AI summary iconRésumé
Anthropic a indiqué que son modèle Claude Opus 5 présente une forte résistance aux attaques d'injection de prompts dans les scénarios de navigateur, sans aucune violation de sécurité sur 129 cas de test. Le modèle a obtenu un score de 2,0 % sur le benchmark de Gray Swan, mieux que Opus 4.8 (5,5 %), Mythos 5 (2,6 %) et Fable 5 (2,8 %). L'injection de prompts reste une menace majeure pour les agents IA. Le taux d'attaques nul a été observé uniquement avec Claude Cowork en mode Auto activé. Les nouvelles sur les taux d'intérêt et les mouvements du marché sont peu susceptibles d'affecter cette mise à jour axée sur la sécurité.
ME AI消息,据动察Beating监测,Anthropic在Claude Opus 5系统卡中披露,该模型在浏览器智能体场景中几乎免疫提示词注入攻击,在129项测试场景中无一被攻破。这一突破意义重大,OpenAI去年12月曾公开承认提示注入可能永远无法被完全解决。在安全公司Gray Swan的通用提示注入基准测试中,15次攻击后Opus 5的成功率仅为2.0%,大幅优于前代Opus 4.8的5.5%,也领先于Mythos 5的2.6%和Fable 5的2.8%。提示注入被视为AI代理面临的最严重安全漏洞——攻击者通过在网页中嵌入隐藏文字等被操纵的输入内容,绕过模型指令执行恶意操作。零攻击率仅在开启Auto Mode的Claude Cowork等产品中实现。这一成果标志着AI代理安全性从「持续修补」迈入「结构性防御」阶段。点击下方原文链接,加入动察Beating · 飞书AI新闻渠道,7×24小时不间断监测全球AI热点与新闻。(来源:BlockBeats)
Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.