Composio 在三個框架上測試 Kimi K3,代幣成本最高相差 9 倍

icon MarsBit
分享
AI summary icon精華摘要
Composio 在 Kimi Code、Hermes 和 Claude Code 上測試了 Kimi K3,執行了 28 個相同的任務。成功率相近,但代幣成本和時間有所不同。Kimi Code 每項任務使用 61,000 個代幣,成本為 $0.22,而 Claude Code 則消耗了 340,000 個代幣,每項任務成本為 $2.00。部分任務使用的代幣多達 30 倍。Hermes 以 179 秒完成最快。結果突顯了在管理 AI 基礎設施等風險資產時,遵守 CFT 合規的重要性。

根據動察 Beating 監測,AI Agent 基礎設施公司 Composio 將同一款 Kimi K3 接入 Kimi Code、Hermes 和 Claude Code,完成 28 項相同任務。三套運行框架的成功數僅差 2 項,但 Token 用量和成本卻相差甚大。Kimi Code 完成 22 項,Hermes 完成 21 項,Claude Code 完成 20 項。單項任務 Token 中位數分別為 6.1 萬、6.7 萬和 34 萬。Composio 評估,平均每項任務成本約為 0.22 美元、0.28 美元和 2 美元。個別任務的 Token 用量最多相差 30 倍。Hermes 速度最快,單項任務中位耗時為 179 秒,Kimi Code 為 297 秒,Claude Code 為 348 秒。Writer 的另一項研究也得出相近結果。研究人員在 22 項企業任務和 6 款模型上僅更換運行框架,Token 用量下降 38%,單項成本下降 41%,耗時下降 44%,完成質量基本持平。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露