Kimi K3 性能測試顯示,Claude Code 的成本比 Kimi Code 高 9 倍

iconChainthink
分享
AI summary icon精華摘要
新代幣上線帶來了最新的表現數據,Composio 在 28 個相同任務中測試了 Kimi K3、Kimi Code、Hermes 和 Claude Code。完成率相近,分別為 22、21 和 20,但代幣使用量和成本有所不同。Kimi Code 每項任務使用 61,000 個代幣,成本為 $0.22;而 Claude Code 則使用 340,000 個代幣,成本為 $2。另一項研究顯示,更換運行時框架可將代幣使用量減少 38%,成本降低 41%。代幣發行新聞突顯了 AI 代理基礎設施的效率提升。

ChainThink 消息,7 月 30 日,AI Agent 基礎設施公司 Composio 將同一款 Kimi K3 分別接入 Kimi Code、Hermes 和 Claude Code,執行 28 項相同任務。

三套運行框架的完成數分別為 22 項、21 項和 20 項,差距較小,但 Token 用量和成本差異明顯。

測試顯示,Kimi Code、Hermes、Claude Code 的單項任務 Token 中位數分別為 6.1 萬、6.7 萬和 34 萬;

Composio 評估,每項任務的平均成本約為 0.22 美元、0.28 美元和 2 美元。個別任務的 Token 使用量最多相差 30 倍。

在速度方面,Hermes 的單項任務中位耗時為 179 秒,Kimi Code 為 297 秒,Claude Code 為 348 秒。

Writer 的另一項研究也顯示,在 22 項企業任務和 6 款模型上僅替換運行框架後,Token 用量下降 38%,單項成本下降 41%,耗時下降 44%,完成質量基本持平。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露