OpenAIは9月1日、未リリースのAstraが同社の「準備フレームワーク」における「キーカテゴリー」のサイバーセキュリティ基準を達成したと発表しました。これはOpenAIが初めてモデルをこのカテゴリーに含めたことを意味し、開発およびリリース前により厳格なセキュリティ制限が適用されることを示しています。
初めてキーレベルに到達
OpenAIの定義によると、モデルが複数の強化された実システムで未知の脆弱性を独自に発見し、有効な攻撃チェーンを構築できる場合、または高レベルの目標のみに基づいて高難易度のターゲットに対する完全なネットワーク攻撃を実行できる場合、それは「クリティカルレベル」と分類される。これまでにGPT-5.6 Solを含むモデルは、最高でも「ハイリスク」レベルにとどまっていた。
テスト中に2つのゼロデイ脆弱性を発見
脆弱性利用テストExploitBenchにおいて、Astraの合格率は100%でした。このテストは、既知のソフトウェア脆弱性を実行可能なエクスプロイトコードに変換できるかどうかを主に評価します。
メモリーテストの影響を排除するため、OpenAIは2024年6月から8月に公表されたGoogle V8 JavaScriptエンジンの高脅威脆弱性20件を内部テストに使用しました。OpenAIは、Astraが任意コード実行の成功率でGPT-5.6 Solを上回り、使用した出力トークン数も少ないことを報告しています。テスト中、Astraはこれまで知られていなかった2つのゼロデイ脆弱性を自ら発見し、それらを連鎖させました。関連する問題は、影響を受けるメンテナーへの開示が進行中です。
まず少数のテスト参加者に開放します
より実戦に近いテストにおいて、Astraは強化されたブラウザと強化されたオペレーティングシステムのセットを用いて、完全な侵入チェーンを構築しました。OpenAIは、モデルがターゲットに悪意のあるHTMLファイルを開かせるだけで、ブラウザサンドボックスを脱出し、ホスト上でコマンドを実行したと述べています。別のテストでは、複数のシステムの脆弱性を連結して権限昇格のパスを構築し、一般ユーザーアカウントが最終的にroot権限を取得できるようにしました。
OpenAIは、Astraが内部テストでネットワークセキュリティのジャイル提示に対する拒否率を91.5%まで達成したことを発表しました。これはGPT-5.6 Solの59%を上回ります。Astraの最も強力なネットワークセキュリティ機能は、まず少数のalphaテストユーザーに提供され、その後、Daybreak Blueプロジェクトを通じて段階的に拡大され、主に防御的なセキュリティ作業に焦点を当てます。
追加情報:この開示が発表された同日、AnthropicはFable 5.1とMythos 5.1をリリースし、Mythos 5.1は引き続き審査済みのサイバーセキュリティおよびライフサイエンス機関にのみ提供されています。OpenAIは現在、Astraの正式なリリース日を発表していません。
