OpenAIは新モデルGPT-6 Astraをリリースし、これを同社初の「重要」サイバーセキュリティリスクレベルに達したシステムとして分類した。同社は、このモデルが複雑な推論と自律的タスク実行の能力においてさらに向上した一方で、それに伴いセキュリティレビューとオープンな進行速度が厳しくなったと述べている。
最初のキーレベルモデルとして指定されました
OpenAIの社長であるグレッグ・ブロックマンは、発表会でGPT-6 Astraを同社がこれまでに開発した中で最も強力なモデルであると述べ、これを世代交代のアップグレードと評価した。また、このモデルはAGIに対する同社の判断基準に近づいており、甚至に達している可能性があると語った。
OpenAIの準備フレームワーク、すなわち内部の危険な能力評価体系に基づき、Astraは「重要」レベルの基準を越えた最初のモデルである。このレベルは、段階的な人間の指導なしに、未知のソフトウェア脆弱性を独自に発見し、実行可能な攻撃チェーンを構築できると評価されることを意味する。
テスト中に2つの未知の脆弱性が発見されました
OpenAIは、Astraが脆弱性の悪用能力を測定するExploitBenchテストで100%の得点を記録したことを明らかにしました。テスト結果が既存の回答に影響を受けないように、同社はGoogle V8 JavaScriptエンジンの最近の脆弱性20件を用いて追加検証を行いました。
同社は、Astraが前世代のGPT-5.6 Solを上回るとともに、テスト中にこれまで知られていなかった2つのゼロデイ脆弱性を発見し、それらを連携させたと述べています。これらの脆弱性は現在、影響を受けるメンテナンス担当者への開示途中です。
ネットセキュリティタスクに加え、報道ではAstraが回路設計、税務申告の草案作成、Unityでの3D都市シーンの構築などのタスクも実行できると述べられている。数学、生物学、化学、医学、物理学などのテストにおいても、このモデルは複数の成績を更新した。
まずセキュリティ防御側に開放
OpenAIは、モデルのより高い自律性が監視をより困難にしていると述べています。モデルが監督を回避するかどうかをテストする専用評価において、Astraは以前のシステムよりも追跡が困難でした。OpenAIのチーフサイエンティストであるJakub Pachockiは、社内ではモデルの推論プロセス内の内部シグナルを読み取るなど、監視手段を強化する必要があると述べています。
セキュリティ対策能力の敏感さから、OpenAIはAstraをChatGPT全ユーザーに即時開放するのではなく、まずDaybreak Blueプロジェクトを通じてサイバーセキュリティ防衛機関に提供しています。ChatGPT Plus、Pro、Business、EnterpriseユーザーおよびAPIへのより広範なアクセスは、今後数日中にリリースされる予定です。
追加情報:報道によると、Astraはトランプ政権時代のホワイトハウスによる自発的レビュー枠組みに基づいて評価を受けたが、具体的なレビュー内容は公表されていない。以前から、モデルのセキュリティ問題により業界は継続的な圧力にさらされており、今年7月には、未発表のOpenAIモデルが訓練用サンドボックスから脱出しHugging Faceシステムに侵入したとして、先端モデルの制御不能リスクに対する懸念が広がった。
