Ang GPT-6 Astra ng OpenAI ay nangunguna sa Code Arena WebDev Leaderboard na may 1,797 puntos

iconCryptoBriefing
I-share
AI summary iconSummary
Ang on-chain news ay nagpapakita na ang OpenAI’s GPT-6 Astra ay nangunguna sa Code Arena WebDev leaderboard na may 1,797 puntos, na nagwagi sa Anthropic’s Claude Fable 5.1 ng 35 puntos. Ang modelong ito ay nakamit ang unang puwesto dalawang araw lamang pagkatapos ng paglunsad nito noong Setyembre 3, 2026. Gumagamit ang Code Arena ng crowdsourced na Elo-style system upang i-rank ang mga modelong batay sa mga totoong frontend task, na may higit sa 650,000 boto sa 126 na modelo. Patuloy ang RWA news na nagpapakita ng lumalaking papel ng AI sa pag-unlad.

Ang GPT-6 Astra ng OpenAI ay nakuha ang unang puwesto sa Code Arena’s WebDev leaderboard na may marka na 1,797, na nagtataglay ng 35 puntos na kalayuan sa Anthropic’s Claude Fable 5.1 na nasa 1,762. Dalawang araw pagkatapos ng opisyal na paglunsad nito noong Setyembre 3, 2026, ang modelo ay nagsisikap nang muli ang pagkakasunod-sunod sa AI-assisted web development.

Ang leaderboard, na pinapatakbo ng Arena.ai, ay hindi ang karaniwang static na benchmark. Gumagamit ito ng crowdsourced na Elo-style na sistema ng pagrereporma, ang parehong uri ng mekanismo ng pagrango na ginagamit sa kompetitibong chess, kung saan ang mga miyembro ng komunidad ay bumoto kung gaano kahusay ang mga AI model sa pagharap sa mga aktwal na frontend coding tasks. Naka-ilog na higit sa 650,000 boto sa 126 na model, gawaing ito ang isa sa mga pinakamalakas na pagtataya ng komunidad sa larangan ng AI.

Paghahayag

Ano ang nagpapakilos sa benchmark na ito

Ang mga tradisyonal na benchmark ng AI ay karaniwang sinusubok ang mga modelo laban sa mga fixed na dataset na may mga nakapaghahatid na tamang sagot. Ang Code Arena ay gumagamit ng ibang pagkakasunod-sunod. Sinusubok ang mga modelo batay sa multi-step na pag-iisip, paggamit ng mga tool, at iteratibong coding workflows, o kaya'y ang maingay, nonlinear na proseso na kasama sa tunay na web development.

Ang 1,797 na marka ng GPT-6 Astra ay kumakatawan sa pinakamataas na marka na natamo ng anumang modelo sa partikular na leaderboard. Ang Claude Fable 5.1, ang pinakabagong kandidato ng Anthropic, ay naka-hold sa 1,762.

Nagiging mas puno ang kompetisyon

Hindi lamang ang OpenAI at Anthropic ang mga tagapaglalaro na nag-aabot ng position. Nakikita sa mga nakaraang snapshot mula sa leaderboard ng Setyembre ang mga modelo mula sa mga developer sa Tsina na nag-aaway para sa mga top ranking.

Ang GPT-6 Astra (Max) at ang Claude Fable 5.1 (Max) ay may parehong presyo na $10 bawat milyong input tokens at $50 bawat milyong output tokens. Parehong nag-aalok ng context window na 1 milyong tokens.

Ang OpenAI ay naglagay ng GPT-6 Astra bilang pinakamalalim na modelo nito para sa software engineering at mga kaugnay na aplikasyon. Ang modelo ay kasalukuyang available sa mga subscriber ng ChatGPT at mga pili API at cloud partner.

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.