Claude Opus 5 在瀏覽器情境下可抵禦提示注入攻擊

iconKuCoinFlash
分享
AI summary icon精華摘要
Anthropic 報告指出,其 Claude Opus 5 模型在瀏覽器情境下對提示注入攻擊具有強大抵抗力,在 129 個測試案例中未發生任何安全漏洞。該模型在 Gray Swan 的基準測試中得分為 2.0%,優於 Opus 4.8(5.5%)、Mythos 5(2.6%)和 Fable 5(2.8%)。提示注入仍是 AI 代理的主要威脅。僅有開啟自動模式的 Claude Cowork 達到零攻擊率。利率新聞和市場波動不太可能影響此項以安全為重點的更新。
ME AI 消息,據 動察 Beating 監測,Anthropic 在 Claude Opus 5 系統卡中披露,該模型在瀏覽器代理場景中幾乎免疫提示詞注入攻擊,在 129 項測試場景中無一被攻破。這一突破意義重大,OpenAI 去年 12 月曾公開承認提示注入可能永遠無法被完全解決。在安全公司 Gray Swan 的通用提示注入基準測試中,15 次攻擊後 Opus 5 的成功率僅為 2.0%,大幅優於前代 Opus 4.8 的 5.5%,也領先於 Mythos 5 的 2.6% 和 Fable 5 的 2.8%。提示注入被視為 AI 代理面臨的最嚴重安全漏洞——攻擊者通過在網頁中嵌入隱藏文字等被操縱的輸入內容,繞過模型指令執行惡意操作。零攻擊率僅在開啟 Auto Mode 的 Claude Cowork 等產品中實現。這一成果標誌著 AI 代理安全性從「持續修補」邁入「結構性防禦」階段。點擊下方原文連結,加入動察 Beating · 飛書 AI 新聞渠道,7×24 小時不間斷監測全球 AI 熱點與新聞。(來源:BlockBeats)
免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露