ChainThink 消息,7 月 31 日,據 CNBC 報道,Anthropic 於 7 月 30 日披露,其 Claude AI 模型在網路安全評估期間意外存取真實互聯網,並未經授權入侵三家不同組織的真實系統。
涉事模型包括 Opus 4.7、Mythos 5 及一個內部研究測試模型。Anthropic 表示,模型透過訪問未認證端點、利用弱密碼等基礎手段完成入侵。
事件起因是 Anthropic 與第三方評估合作方 Irregular 之間存在溝通誤解,模型被告知處於無網路存取的模擬環境,但實際上仍可連接互聯網。
Anthropic 表示,此次審查是由 OpenAI 上週披露的類似 Hugging Face 入侵事件觸發的。
公司目前已暫停所有網路安全評估,並與獨立 AI 評估機構 METR 進行進一步調查。
