Opus 5 surpasse Fable 5 en score d'intelligence et réduit le coût des tâches de 26 %

iconChainthink
Partager
AI summary iconRésumé
Le 25 juillet, l'entreprise d'évaluation tierce Artificial Analysis a révélé qu'Opus 5 a surpassé Fable 5 dans un test d'intelligence comprenant neuf éléments, avec un score de 61 contre 60 pour Fable 5. L'indice de peur et de cupidité reste prudent, car Opus 5 a réduit le coût moyen des tâches à 2,03 $, soit une amélioration de 26 %. Il a obtenu les meilleurs résultats lors des évaluations GDPval-AA v2 et AA-Briefcase, et a partagé la première place dans l'indice des agents de programmation avec Claude Code. Opus 5 reste néanmoins en retard sur Fable 5 en termes de précision factuelle, avec un taux d'hallucinations de 50 % dans AA-Omniscience. Les traders suivent de près les altcoins à surveiller, car la rentabilité du raisonnement d'Opus 5 reste légèrement en dessous de celle de GPT-5.6.

ChainThink, le 25 juillet, selon l'organisme d'évaluation tiers Artificial Analysis, Claude Opus 5 obtient un score de 61 points à l'indice d'intelligence basé sur neuf tests combinés, devançant légèrement Fable 5 qui obtient 60 points.

GPT-5.6 Sol obtient un score de 59, Kimi K3 obtient un score de 57. En termes de coût, Opus 5 coûte en moyenne 2,03 $ par tâche, soit 26 % de moins que les 2,75 $ de Fable 5.

Ce modèle occupe la première place lors des évaluations de travail intellectuel GDPval-AA v2 et AA-Briefcase, et partage la première place de l'indice des agents de programmation avec Claude Code ;

Terminal-Bench v2.1 obtient un score de 89 %, à peu près équivalent à GPT-5.6 Sol. Opus 5 offre 5 niveaux d'intensité d'inférence.

De low à max, les tokens diffèrent d'environ 8 fois, et les résultats de GDPval-AA v2 varient de 407 Elo ; les utilisateurs peuvent ajuster entre performance et coût.

Les évaluations montrent également que les connaissances factuelles d'Opus 5 sont toujours inférieures à celles de Fable 5. Dans le test AA-Omniscience, son taux d'hallucinations a augmenté à 50 %, soit 14 points de pourcentage de plus qu'avec Opus 4.8 ;

Le rapport qualité-prix du niveau de raisonnement bas reste légèrement inférieur à celui de la série GPT-5.6.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.