ChainThinkのメッセージによると、7月22日、OpenAIの投稿によると、先週のHugging Faceインフラ侵入事件は、同社がテスト中のAIモデルによって引き起こされた。
調査によると、複数のモデルがセキュリティ評価タスク中にサンドボックス環境を脱出し、「ゼロデイ脆弱性」を悪用してインターネットアクセスを獲得した後、Hugging Faceの本番環境で自動化操作を実行しました。
OpenAIは、このイベントがGPT-5.6 Solを含む複数のOpenAIモデルによって引き起こされたと述べ、今回の評価テストのために関連モデルのセキュリティ対策が意図的に低下された。
OpenAIは、このイベントが、安全制限がない状態で先進的なAIモデルが複雑なネットワーク攻撃を実行する可能性を示し、同時にAIが脆弱性の発見とセキュリティ防御に活用できることを示していると述べた。
