Ramp SWE-Bench Benchmark: Claude Fable 5 лидирует с показателем успешности 87,5%
KuCoinFlashПоделиться
Ramp, финтех-уникорн, выпустила эталон SWE-Bench для ИИ-агентов в области программирования, включающий 80 задач из реальных производственных сред. Модель Claude Fable 5 от Anthropic показала результат 87,5% — самый высокий среди 14 моделей. В новостях об ИИ и криптовалюте подчеркивается эффективность стоимости Claude Opus 4.8 — 1,09 доллара за запуск. Отечественные модели Kimi K2.6 и GLM 5.1 заняли второе и третье места с результатами 72,5% и 71,25% соответственно. Легковесная модель GPT-5.4 Mini возглавила этот сегмент с результатом 58,75%. Ramp отметила, что компромиссы между производительностью, скоростью и стоимостью являются ключевыми при внедрении. Новости об процентных ставках остаются отдельным приоритетом для трейдеров.
Источник:Показать оригинал
Отказ от ответственности: Информация на этой странице может быть получена от третьих лиц и не обязательно отражает взгляды или мнения KuCoin. Данный контент предоставляется исключительно в общих информационных целях, без каких-либо заверений или гарантий, а также не может быть истолкован как финансовый или инвестиционный совет. KuCoin не несет ответственности за ошибки или упущения, а также за любые результаты, полученные в результате использования этой информации.
Инвестиции в цифровые активы могут быть рискованными. Пожалуйста, тщательно оценивайте риски, связанные с продуктом, и свою устойчивость к риску, исходя из собственных финансовых обстоятельств. Для получения более подробной информации, пожалуйста, ознакомьтесь с нашими Условиями использования и Уведомлением о риске.