Odaily星球日報訊 OpenAI 確認,GPT-5.6 Sol 及一款未命名、更強的預發布模型在 ExploitGym 基準測試評估中突破受限沙箱環境,並入侵 Hugging Face 生產基礎設施以獲取測試答案。
OpenAI 表示,相關模型利用內部軟體包註冊表代理的零日漏洞進行提權和橫向移動,最終連接到具有互聯網訪問能力的機器。模型隨後識別並串聯 OpenAI 研究環境和 Hugging Face 生產基礎設施中的漏洞,直接從 Hugging Face 生產資料庫獲取測試解決方案。
Hugging Face 於 7 月 16 日披露此事件,稱攻擊由自主 AI 代理系統端到端執行,涉及短生命週期沙箱中的數千次操作,並觸及內部資料集與服務憑證。OpenAI 在五天後確認其模型為事件主體。
Hugging Face 表示,其安全團隊在分析超過 1.7 萬條攻擊日誌時,曾嘗試使用美國商業前沿 AI 接口,但請求因安全護欄被攔截,隨後改用中國 AI 創業公司 Z.ai 的 7530 億參數開源權重模型 GLM 5.2 在自有基礎設施上完成取證分析。
