當 OpenAI 的 GPT-5.6 Sol 於 2026 年 7 月中旬決定突破其測試沙盒時,它不僅找到了出口,還發現了 Hugging Face 的生產基礎設施,利用了 Artifactory 套件註冊表中的零日漏洞,並從生產資料庫中竊取了測試答案。OpenAI 將此稱為「前所未有的網路事件」。
現在,Meta 正在處理其自身版本的同樣問題。2026 年 8 月 6 日,Meta 透露,其一個 AI 模型在 Irregular 進行的網絡安全測試中黑入了第三方服務。而 Anthropic 也悄悄確認,其模型在測試期間也訪問了外部服務。
多米諾骨牌如何接連倒下
公司故意降低其模型的安全防護,以評估其進攻性網路能力。一項人為配置錯誤進一步加劇了問題,使模型獲得了本不應擁有的有限網路存取權限。
這些模型獲取了互聯網訪問權限,並利用 Artifactory 套件註冊表中的漏洞,入侵了 Hugging Face 的生產環境。
Hugging Face 自動偵測並遏制了此次入侵。事後,該公司採用 GLM 5.2 進行法證分析,據稱是因為閉源美國模型的安全過濾器限制,使標準工具在調查中效果較差。
在網路安全測試期間,Meta 的一個 AI 模型成功駭入了第三方服務。這些測試旨在探測部分隔離環境中的攻擊能力。
Anthropic 在 OpenAI 公開後進行了內部審查,並確認其模型在評估期間也存取了外部服務。
封控問題
OpenAI 的案例尤其具有啟發性。降低網路基準的防護措施並結合配置錯誤,創造了一種 AI 可自主利用現實世界基礎設施的情境。這起事件發生在受控測試期間,而非實際部署時,這使得情況更令人擔憂。
