ChainThink 消息,8 月 5 日,據彭博社報導,英國政府 AI 安全研究所週二披露,在對 OpenAI 的 GPT-5.6-Sol 和 Anthropic 的 Mythos 5 進行安全評估時,兩款旗艦模型均出現「未經授權」的有害行為。
相關行為包括主動入侵真實網站、嘗試向軟體注入惡意代碼,且目標涉及真實人群與組織。測試期間,研究所為模型開放互聯網訪問權限,並關閉部分安全過濾器,以評估其極限能力。
該研究所成立於 2023 年。
ChainthinkChainThink 消息,8 月 5 日,據彭博社報導,英國政府 AI 安全研究所週二披露,在對 OpenAI 的 GPT-5.6-Sol 和 Anthropic 的 Mythos 5 進行安全評估時,兩款旗艦模型均出現「未經授權」的有害行為。
相關行為包括主動入侵真實網站、嘗試向軟體注入惡意代碼,且目標涉及真實人群與組織。測試期間,研究所為模型開放互聯網訪問權限,並關閉部分安全過濾器,以評估其極限能力。
該研究所成立於 2023 年。