OpenAIのGPT-6 Astraが1,797点でCode Arena WebDevランキング1位に

iconCryptoBriefing
共有
AI summary icon概要
オンチェーンニュースによると、OpenAIのGPT-6 Astraが1,797点を獲得し、AnthropicのClaude Fable 5.1を35点上回ってCode Arena WebDevランキングで1位となりました。このモデルは2026年9月3日のリリースからたった2日で1位に達しました。Code Arenaは、126のモデルに対して65万件以上の投票を集めた、現実のフロントエンドタスクに基づくクラウドソーシング型Elo方式でモデルをランキングしています。リアルワールドアセット(RWA)に関するニュースも、開発におけるAIの役割が拡大していることを引き続き強調しています。

OpenAIのGPT-6 Astraが、Code ArenaのWebDevランキングで1,797点を記録し、1,762点のAnthropicのClaude Fable 5.1を35点差で上回って1位を獲得しました。2026年9月3日に正式にリリースされてからたった2日で、このモデルはAI支援Web開発の順位を再定義しています。

Arena.aiが運営するリーダーボードは、従来の静的なベンチマークではありません。これは、競技チェスで使用されるような、コミュニティメンバーがAIモデルのリアルワールドのフロントエンドコーディングタスクに対するパフォーマンスを評価する、クラウドソーシングされたEloスタイルのレーティングシステムを採用しています。126のモデルに対して65万票以上が記録されており、これはAI分野で最も堅牢なコミュニティ評価の一つとなっています。

広告

このベンチマークを特別にしているのは何ですか

従来のAIベンチマークは、固定されたデータセットと事前に定義された正解を用いてモデルを評価しますが、Code Arenaは根本的に異なるアプローチを採用しています。モデルは、複数ステップの推論、ツールの活用、反復的なコーディングワークフローに基づいて評価され、これは実際のウェブ開発に伴う、曖昧で非線形なプロセスそのものです。

GPT-6 Astraの1,797というスコアは、この特定のリーダーボードでこれまでに達成された最高点です。Anthropicの最新の競合モデルであるClaude Fable 5.1は、1,762を堅調に維持していました。

競合環境が混雑してきています

OpenAIやAnthropicだけが地位をめぐって競争しているわけではありません。9月のリーダーボードの以前のスナップショットには、中国の開発者が両社とトップランキングを競うモデルを示していました。

GPT-6 Astra (Max) および Claude Fable 5.1 (Max) は、いずれも入力トークン100万トークンあたり10ドル、出力トークン100万トークンあたり50ドルで価格が同じです。両方とも100万トークンのコンテキストウィンドウを提供します。

OpenAIは、GPT-6 Astraをソフトウェアエンジニアリングおよび関連アプリケーション向けの最高峰モデルとして位置づけています。このモデルは、現在ChatGPTのサブスクライバーおよび選ばれたAPIおよびクラウドパートナーに提供されています。

免責事項: 本ページの情報はサードパーティからのものであり、必ずしもKuCoinの見解や意見を反映しているわけではありません。この内容は一般的な情報提供のみを目的として提供されており、いかなる種類の表明や保証もなく、金融または投資助言として解釈されるものでもありません。KuCoinは誤記や脱落、またはこの情報の使用に起因するいかなる結果に対しても責任を負いません。 デジタル資産への投資にはリスクが伴います。商品のリスクとリスク許容度をご自身の財務状況に基づいて慎重に評価してください。詳しくは利用規約およびリスク開示を参照してください。