Opus 5、Fable 5を知能スコアで上回り、タスクコストを26%削減

iconChainthink
共有
AI summary icon概要
7月25日、第三者評価機関Artificial Analysisは、Opus 5が9項目からなる知能テストでFable 5を上回り、61点対60点を記録したことを発表しました。Opus 5が平均タスクコストを2.03ドルに引き下げ、26%の改善を達成したため、フィアーアンドグリードインデックスは依然として慎重な姿勢を維持しています。Opus 5はGDPval-AA v2およびAA-Briefcaseの評価でトップとなり、プログラミングエージェントインデックスではClaude Codeと並んで最高位を獲得しました。ただし、AA-Omniscienceでの幻覚率が50%であるため、Opus 5は事実正確性において依然としてFable 5に劣っています。トレーダーたちは、Opus 5の推論コスト効率がGPT-5.6にやや及ばないことを踏まえ、注目すべきアルトコインに目を向け続けています。

ChainThinkのメッセージによると、7月25日、第三者評価機関Artificial Analysisの調査によると、Claude Opus 5は9つのテストを総合した知能指数で61点を獲得し、Fable 5の60点をわずかに上回りました。

GPT-5.6 Solは59点、Kimi K3は57点。コスト面では、Opus 5の1タスクあたり平均コストは2.03ドルで、Fable 5の2.75ドルより26%低い。

このモデルは、GDPval-AA v2およびAA-Briefcaseの両方の知識作業評価で1位を獲得し、Claude Codeと組み合わせた場合、プログラミングエージェント指数で1位に並びました;

Terminal-Bench v2.1 のスコアは89%で、GPT-5.6 Sol にほぼ並びました。Opus 5 は5段階の推論強度を提供します。

lowからmaxまで、トークンの差は約8倍、GDPval-AA v2の成績は407 Eloの差があります。ユーザーはパフォーマンスとコストの間で調整できます。

評価結果によると、Opus 5 の事実知識は依然としてFable 5に劣っています。AA-Omniscienceテストでは、その幻覚率が50%に上昇し、Opus 4.8より14ポイント高くなりました。

低推論ランクのコストパフォーマンスは、依然としてGPT-5.6シリーズやや劣ります。

免責事項: 本ページの情報はサードパーティからのものであり、必ずしもKuCoinの見解や意見を反映しているわけではありません。この内容は一般的な情報提供のみを目的として提供されており、いかなる種類の表明や保証もなく、金融または投資助言として解釈されるものでもありません。KuCoinは誤記や脱落、またはこの情報の使用に起因するいかなる結果に対しても責任を負いません。 デジタル資産への投資にはリスクが伴います。商品のリスクとリスク許容度をご自身の財務状況に基づいて慎重に評価してください。詳しくは利用規約およびリスク開示を参照してください。