ChainThink संदेश, 1 अगस्त, AI एजेंट बुनियादी ढांचा कंपनी Composio ने परीक्षण का विस्तार किया, जिसमें एक ही Kimi K3 को 6 एजेंट फ्रेमवर्क में जोड़ा गया और 26 समान कार्य पूरे किए गए।
इस तुलना में तुलना फ्रेमवर्क के आधार पर की गई है, जिसका नींव का मॉडल Kimi K3 है। परीक्षण परिणामों के अनुसार, Kimi Code ने 21 कार्य पूरे किए और पहला स्थान प्राप्त किया; Hermes ने 20 कार्य पूरे किए;
Pi Agent और Claude Code ने दोनों 19 कार्य पूरे किए; OpenCode ने 18 कार्य पूरे किए; Codex ने 17 कार्य पूरे किए।
किमी K3 के आधिकारिक मूल्य के अनुसार, हरमेस और पाई एजेंट की प्रत्येक कार्य की औसत लागत सबसे कम है, क्रमशः 0.39 डॉलर और 0.40 डॉलर;
Claude Code की कीमत 1.47 डॉलर है, जो Hermes की तुलना में लगभग 3.8 गुना है। गति के मामले में, Pi Agent का एकल कार्य का माध्यिका समय 161.7 सेकंड है, जबकि Claude Code का 347.6 सेकंड है।
टेस्टिंग दर्शाती है कि एक ही मॉडल के तहत फ्रेमवर्क बदलने पर सफल कार्यों की संख्या में अधिकतम 4 का अंतर होता है, औसत लागत लगभग 4 गुना अलग होती है, और समय लगभग 2 गुना अधिक होता है।
