ChainThink сообщает, 1 августа компания Composio, инфраструктурный провайдер AI Agent, расширила тестирование, подключив ту же самую модель Kimi K3 к шести платформам Agent и выполнив 26 одинаковых задач.
Сравнение проводилось по фреймворкам, базовые модели у всех — Kimi K3. Результаты тестирования показали, что Kimi Code выполнил 21 задачу и занял первое место; Hermes выполнил 20 задач;
Pi Agent и Claude Code выполнили по 19 задач; OpenCode — 18; Codex — 17.
Согласно официальной цене Kimi K3, Hermes и Pi Agent имеют наименьшую среднюю стоимость за задачу — 0,39 доллара и 0,40 доллара соответственно;
Claude Code стоит 1,47 доллара США, что примерно в 3,8 раза больше, чем у Hermes. По скорости, медианное время выполнения одиночной задачи Pi Agent составляет 161,7 секунды, а у Claude Code — 347,6 секунды.
Тесты показали, что при смене фреймворка в одной и той же модели количество успешных задач различается максимум на 4, средняя стоимость отличается почти в 4 раза, а время выполнения — более чем в 2 раза.
