GPT-6 Astra de OpenAI lidera el ranking de Code Arena WebDev con 1.797 puntos

iconCryptoBriefing
Compartir
AI summary iconResumen
Las noticias en cadena muestran que GPT-6 Astra de OpenAI ha ocupado el primer lugar en el ranking de Code Arena WebDev con 1.797 puntos, superando a Claude Fable 5.1 de Anthropic por 35 puntos. El modelo alcanzó el primer puesto solo dos días después de su lanzamiento el 3 de septiembre de 2026. Code Arena utiliza un sistema crowdsourced de tipo Elo para clasificar modelos según tareas frontend del mundo real, con más de 650.000 votos en 126 modelos. Las noticias sobre activos del mundo real (RWA) continúan destacando el creciente papel de la IA en el desarrollo.

GPT-6 Astra de OpenAI ha ocupado el primer lugar en el ranking de WebDev de Code Arena con una puntuación de 1.797, estableciendo una diferencia de 35 puntos respecto a Claude Fable 5.1 de Anthropic, que se encuentra en 1.762. Dos días después de su lanzamiento oficial el 3 de septiembre de 2026, el modelo ya está reescribiendo la jerarquía en el desarrollo web asistido por IA.

El ranking, operado por Arena.ai, no es un benchmark estático típico. Utiliza un sistema de calificación tipo Elo impulsado por la comunidad, el mismo mecanismo de clasificación utilizado en ajedrez competitivo, donde los miembros de la comunidad votan sobre qué tan bien los modelos de IA manejan tareas de programación frontend del mundo real. Se han registrado más de 650.000 votos en 126 modelos, lo que convierte a este en una de las evaluaciones comunitarias más sólidas en el ámbito de la IA.

Anuncio

¿Qué hace diferente a este benchmark

Los benchmarks tradicionales de IA suelen evaluar modelos contra conjuntos de datos fijos con respuestas correctas predeterminadas. Code Arena adopta un enfoque fundamentalmente diferente. Los modelos se evalúan en razonamiento multietapa, uso de herramientas y flujos de trabajo de codificación iterativos, esencialmente el proceso desordenado y no lineal que implica el desarrollo web real.

La puntuación de 1.797 de GPT-6 Astra representa la marca más alta lograda por cualquier modelo en este tablero de clasificación específico. Claude Fable 5.1, el último contendiente de Anthropic, había mantenido una posición sólida en 1.762.

El panorama competitivo se está volviendo más concurrido

OpenAI y Anthropic no son los únicos actores compitiendo por posición. Versiones anteriores del ranking de septiembre mostraron modelos de desarrolladores chinos desafiando a ambas empresas por los primeros puestos.

Tanto GPT-6 Astra (Max) como Claude Fable 5.1 (Max) tienen el mismo precio: $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Ambos ofrecen una ventana de contexto de 1 millón de tokens.

OpenAI ha posicionado a GPT-6 Astra como su modelo más avanzado para ingeniería de software y aplicaciones afines. El modelo actualmente está disponible para suscriptores de ChatGPT y socios seleccionados de API y nube.

Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información. Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.