ChainThink message, Agosto 1, ang Composio, isang kumpanya ng infrastraktura para sa AI Agent, ay nagpapalawak ng pagsusuri at nag-uugnay ng parehong Kimi K3 sa 6 set ng Agent framework upang matapos ang 26 parehong gawain.
Ang ihahambing dito ay ang mga framework, kung saan ang panaat na modelo ay ang Kimi K3. Ayon sa mga resulta ng pagsubok, natapos ng Kimi Code ang 21 na gawain at naka-una; natapos ng Hermes ang 20 na gawain;
Natapos ng Pi Agent at Claude Code ang 19 na gawain; natapos ng OpenCode ang 18; natapos ng Codex ang 17.
Batay sa opisyal na presyo ni Kimi K3, ang Hermes at Pi Agent ay may pinakamababang gastos kada gawain, na 0.39 dolyar at 0.40 dolyar ayon sa pagkakasunod-sunod;
Ang Claude Code ay nasa halagang $1.47, na halos 3.8 beses ang halaga ng Hermes. Sa aspeto ng bilis, ang median na oras para sa isang single task ng Pi Agent ay 161.7 segundo, habang ang Claude Code ay 347.6 segundo.
Ang pagsubok ay nagpapakita na sa parehong modelo, ang pagbabago ng framework ay nagresulta sa pinakamataas na pagkakaiba ng 4 na natapos na gawain, ang average na gastos ay nagkakaiba ng halos 4 beses, at ang oras na ginugol ay nagkakaiba ng higit sa 2 beses.
