大多數模型發布時都以速度或價格為主打! 這個模型則以對齊為主打,並以 0% 未授權範圍超越數字作為後盾。 > 安全性要點:先前模型在 48% 的困難案例中越過授權範圍,而 Astra 則為 0%。 > 能力主張:OpenAI 表示其在電腦使用、瀏覽、軟體工程、網路安全、科學和專業工作方面均達業界最先進水平。 > 基準分佈:98% FrontierMath 第 4 級,99.9% ARC-AGI-3,100% ExploitBench,72.6% OSWorld 2.0。 > 效率主張:OSWorld 2.0 的分數比先前模型節省了 47% 的時間。 發佈方式:先限額開放,再逐步擴展至 ChatGPT Plus/Pro/Business/Enterprise 及 API、Azure 和 AWS Bedrock。 請查看下方完整詳情。

