Ramp SWE-Bench Benchmark: Claude Fable 5 lidera con una tasa de éxito del 87,5%
KuCoinFlashCompartir
Ramp, una unicornio de fintech, ha lanzado su benchmark SWE-Bench para agentes de codificación con IA, que incluye 80 tareas de backend de entornos de producción reales. Claude Fable 5 de Anthropic obtuvo un 87,5 %, la puntuación más alta entre 14 modelos. Las noticias de IA + cripto destacan la eficiencia de costos de Claude Opus 4.8 en $1,09 por ejecución. Los modelos domésticos Kimi K2.6 y GLM 5.1 siguieron con 72,5 % y 71,25 %. GPT-5.4 Mini lideró los modelos ligeros con 58,75 %. Ramp señaló que los compromisos entre rendimiento, velocidad y costo son clave para la implementación. Las noticias sobre tasas de interés siguen siendo un foco separado para los traders.
Fuente:Mostrar original
Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información.
Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.