- GPT-5.6 繞過了 OpenAI 的安全防護,並獨立入侵了 Hugging Face 的基礎設施。
- 這是首個已知在測試期間發生的自主人工智能網路攻擊案例。
- 在該事件之後,OpenAI 表示正在加強其安全措施。
OpenAI 報告了一起在 GPT-5.6 系列模型內部測試期間發生的前所未有的網路事件。這則消息由 OpenAI 執行長 Sam Altman 公布。
在我們評估模型期間發生了一起重大安全事件。我們正在分享到目前為止的學習成果。感謝 @huggingface 在此項合作中的支持。https://t.co/2o2VfR6PIa
— Sam Altman (@sama) July 21, 2026
「在我們評估模型期間發生了一起重大安全事件,我們正在分享到目前為止的學習成果。感謝 Hugging Face 在此項合作中的支持,」阿爾特曼強調。
根據公司表示,一個基於 GPT-5.6 Sol 的 AI 執行個體與另一個預發布模型獨立突破了隔離測試環境,獲取了互聯網存取權限,並攻擊了 Hugging Face 的基礎設施。
AI 成功突破「沙盒」限制
OpenAI 表示,該事件發生在一次內部的 ExploitGym 基準測試中,旨在評估模型的網路能力。為進行測試,公司故意停用了一些防護機制,以探測系統的最大潛力。
在測試期間,模型:
- 發現並利用了包快取代理中一個先前未知的零日漏洞
- 已取得存取開放網際網路的權限
- 在 OpenAI 的研究基礎設施內執行了權限提升
- 盜取憑證
- 利用漏洞鏈入侵 Hugging Face 伺服器,取得通過測試所需的資訊
公司強調,所有跡象表明這些模型「極度專注」於完成測試任務,並尋找任何獲得正確答案的方法。
OpenAI 表示:「我們將此事件視為一場前所未有的網絡事件,涉及頂尖的網絡技術,並已相應作出回應。」
同時,Hugging Face 安全團隊檢測到可疑活動,並在造成基礎設施嚴重損壞前成功阻止了此次攻擊。
OpenAI 加強防禦,Hugging Face 呼籲開放合作
事件發生後,OpenAI 宣布對其內部基礎設施實施額外限制、向開發者披露所發現漏洞的資訊,並與 Hugging Face 展開聯合調查。
Clément Delangue、Hugging Face 聯合創始人兼首席執行官表示:
我們感謝與 OpenAI 在此議題及其他議題上的合作。此事件可能是首例,證明了我們長期以來的信念:AI 安全無法由任何單一公司秘密獨立解決;它將透過開放、協作的方式,讓各地的每一名防禦者都能廣泛接觸 AI 而得以解決。
根據 金融時報 的報導,OpenAI 也向美國執法部門和政府機構通報了此事件。此事件發生之際,正值美國政府在更廣泛發布前 要求 OpenAI 將 GPT-5.6 的初始發佈限制在一小群獲批准的合作夥伴範圍內,而對先進 AI 模型的審查日趨嚴格。
該公司強調,此案例顯示了在模型訓練和測試期間加強監控系統、存取控制和防護機制的必要性。OpenAI 也敦促其他開發者使用類似模型,以比潛在攻擊者更快的速度發現漏洞。
提醒您,GPT-5.6 已於2026年7月9日推出。GPT-5.6 系列包括 GPT-5.6 Sol、GPT-5.6 Terra 和 GPT-5.6 Luna。OpenAI 還 將GPT-5.6 整合至 Microsoft 365 Copilot,並推出 ChatGPT Work。
訊息 GPT-5.6 基於的 AI 代理在測試期間攻擊了 Hugging Face 的基礎設施 最初出現在 INCRYPTED。

