Ramp SWE-Bench Benchmark : Claude Fable 5 arrive en tête avec un taux de réussite de 87,5 %
KuCoinFlashPartager
Ramp, une fintech unicorn, a publié son benchmark SWE-Bench pour les agents de codage par IA, comprenant 80 tâches backend issues d’environnements de production réels. Claude Fable 5 d’Anthropic a obtenu 87,5 %, le meilleur score parmi 14 modèles. Les actualités IA + crypto mettent en avant l’efficacité coûts de Claude Opus 4.8 à 1,09 $ par exécution. Les modèles nationaux Kimi K2.6 et GLM 5.1 ont suivi avec respectivement 72,5 % et 71,25 %. GPT-5.4 Mini a été le leader parmi les modèles légers avec 58,75 %. Ramp a souligné que les compromis entre performance, vitesse et coût sont essentiels pour le déploiement. Les actualités sur les taux d’intérêt restent un axe distinct pour les traders.
Source:Afficher l'original
Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations.
Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.