GPT-6 Astra OpenAI memimpin papan pemimpin Code Arena WebDev dengan 1,797 mata

iconCryptoBriefing
Kongsi
AI summary iconRingkasan
Berita di rantai menunjukkan GPT-6 Astra dari OpenAI memuncaki papan pemimpin Code Arena WebDev dengan 1,797 mata, mengalahkan Claude Fable 5.1 dari Anthropic dengan 35 mata. Model ini mencapai tempat pertama hanya dua hari selepas pelancarannya pada 3 September 2026. Code Arena menggunakan sistem Elo yang disumbang oleh komuniti untuk menghormati model berdasarkan tugas frontend dunia nyata, dengan lebih daripada 650,000 undian merangkumi 126 model. Berita mengenai aset dunia nyata (RWA) terus menonjolkan peranan AI yang semakin meningkat dalam pembangunan.

GPT-6 Astra dari OpenAI telah mendapat tempat pertama di papan pemimpin WebDev Code Arena dengan skor 1,797, menciptakan jarak 35 mata antara dirinya dan Claude Fable 5.1 dari Anthropic yang berada pada 1,762. Dua hari selepas pelancaran rasminya pada 3 September 2026, model ini sudah mengubah urutan peringkat dalam pembangunan web berasaskan AI.

Papan pemimpin, yang dioperasikan oleh Arena.ai, bukanlah tolok ukur statik biasa. Ia menggunakan sistem penilaian gaya Elo yang dikumpulkan dari komunitas, mekanisme peringkat yang sama yang digunakan dalam catur kompetitif, di mana ahli komuniti memberi suara tentang sejauh mana model AI mengendalikan tugas pengkodean frontend dunia nyata. Lebih daripada 650,000 suara telah direkodkan merentas 126 model, menjadikan ini salah satu penilaian komuniti yang paling kukuh dalam bidang AI.

Iklan

Apa yang membuat tolok ukur ini berbeza

Ujian AI tradisional cenderung menguji model terhadap set data tetap dengan jawapan betul yang telah ditentukan sebelumnya. Code Arena mengambil pendekatan yang berbeza secara mendasar. Model dievaluasi berdasarkan penaakulan berbilang langkah, penggunaan alat, dan alur kerja pengkodean berulang, pada dasarnya proses yang kacau dan bukan linear yang terlibat dalam pembangunan web sebenar.

Skor 1,797 GPT-6 Astra mewakili markah tertinggi yang dicapai oleh mana-mana model di papan pemimpin khusus ini. Claude Fable 5.1, calon terkini Anthropic, sebelum ini berada pada 1,762.

Lanskap persaingan semakin sesak

OpenAI dan Anthropic bukan satu-satunya pemain yang bersaing untuk kedudukan. Gambaran awal sebelum ini dari papan pemimpin September menunjukkan model daripada pembangun Cina yang menantang kedua-dua syarikat tersebut untuk tempat teratas.

GPT-6 Astra (Max) dan Claude Fable 5.1 (Max) kedua-duanya dihargakan secara serupa pada $10 per juta token input dan $50 per juta token output. Kedua-duanya menawarkan tetingkap konteks sebanyak 1 juta token.

OpenAI telah menempatkan GPT-6 Astra sebagai model paling canggihnya untuk kejuruteraan perisian dan aplikasi berdekatan. Model ini kini tersedia kepada pelanggan ChatGPT dan rakan API serta awan terpilih.

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.