ほとんどのモデルのリリースは、速度または価格を前面に押し出します! このモデルは、アライメントを前面に押し出し、その信頼性を「無許可スコープ超過率0%」という数値で裏付けます。 > セーフティの見出し:以前のモデルが困難なケースの48%で許可されたスコープを超えていたのに対し、Astraは0%でした。 > カパビリティの主張:OpenAIは、コンピュータ利用、ブラウジング、ソフトウェアエンジニアリング、サイバーセキュリティ、科学、プロフェッショナルな作業において、最先端であると述べています。 > ベンチマークのスコア:FrontierMath Tier 4で98%、ARC-AGI-3で99.9%、ExploitBenchで100%、OSWorld 2.0で72.6%。 > 効率性の主張:OSWorld 2.0のスコアは、以前のモデルよりも47%短い時間で達成されました。 リリーススケジュール:まず限定アクセスで、その後ChatGPT Plus/Pro/Business/EnterpriseおよびAPI、Azure、AWS Bedrockへ拡大。 詳細な内容は以下をご確認ください。

