Opus 5 supera a Fable 5 en puntuación de inteligencia y reduce el costo de la tarea en un 26%

iconChainthink
Compartir
AI summary iconResumen
El 25 de julio, la empresa de evaluación externa Artificial Analysis reveló que Opus 5 superó a Fable 5 en una prueba de inteligencia de nueve ítems, obteniendo 61 frente a los 60 de Fable 5. El índice de miedo y codicia permanece cauteloso, ya que Opus 5 redujo el costo promedio de la tarea a $2.03, una mejora del 26%. Lideró las evaluaciones GDPval-AA v2 y AA-Briefcase y empató en el primer lugar del índice de agentes de programación con Claude Code. Opus 5 aún se encuentra por detrás de Fable 5 en precisión factual, con una tasa de alucinaciones del 50% en AA-Omniscience. Los operadores están monitoreando altcoins clave, ya que la eficacia de costo razonable de Opus 5 sigue ligeramente por detrás de GPT-5.6.

ChainThink mensaje, 25 de julio, según la agencia de evaluación independiente Artificial Analysis, Claude Opus 5 obtuvo una puntuación de 61 puntos en el índice de inteligencia que integra 9 pruebas, liderando ligeramente a Fable 5 con 60 puntos.

GPT-5.6 Sol obtiene 59 puntos, Kimi K3 obtiene 57 puntos. En cuanto a costos, Opus 5 tiene un costo promedio de $2.03 por tarea, un 26% menos que los $2.75 de Fable 5.

Este modelo ocupa el primer lugar en las evaluaciones de trabajo de conocimiento GDPval-AA v2 y AA-Briefcase, y empató en el primer lugar del índice de agentes de programación tras combinarse con Claude Code;

Terminal-Bench v2.1 obtuvo una puntuación del 89%, aproximadamente empatando con GPT-5.6 Sol. Opus 5 ofrece 5 niveles de intensidad de razonamiento.

Desde low hasta max, el Token emitido difiere en aproximadamente 8 veces, y el rendimiento de GDPval-AA v2 varía en 407 Elo; los usuarios pueden ajustar entre rendimiento y costo.

La evaluación también muestra que el conocimiento factual de Opus 5 aún se encuentra por detrás de Fable 5. En la prueba AA-Omniscience, su tasa de ilusiones aumentó hasta el 50%, 14 puntos porcentuales más que Opus 4.8;

El rendimiento por precio del nivel de inferencia bajo sigue siendo ligeramente inferior a la serie GPT-5.6.

Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información. Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.