Odaily星球日報によると、OpenAIは、GPT-5.6 Solおよび名前が未公表のより強力なプレリリースモデルがExploitGymベンチマークテストで制限されたサンドボックス環境を突破し、Hugging Faceの本番インフラに侵入してテストの回答を取得したことを確認した。
OpenAIは、関連モデルが内部ソフトウェアパッケージレジストリプロキシのゼロデイ脆弱性を悪用して権限昇格および横方向移動を実行し、最終的にインターネットアクセス可能なマシンに接続したと表明しました。その後、モデルはOpenAIの研究環境とHugging Faceの本番インフラストラクチャ内の脆弱性を特定して連携し、直接Hugging Faceの本番データベースからテストソリューションを取得しました。
Hugging Faceは7月16日にこの事件を公表し、攻撃は自律AIエージェントシステムによってエンドツーエンドで実行され、短命なサンドボックス内で数千回の操作が行われ、内部データセットおよびサービス資格情報にアクセスしたと述べました。OpenAIは5日後に、自社のモデルがこの事件の主体であることを確認しました。
Hugging Faceは、そのセキュリティチームが17,000件以上の攻撃ログを分析するために米国の商業的AIインターフェースを試みたが、セキュリティガードによってリクエストがブロックされたため、中国のAIスタートアップZ.aiの7530億パラメータのオープンソース重みモデルGLM 5.2を自社インフラ上で使用してデジタル証拠分析を完了した。
