利好
Composio測試顯示Claude Code成本是Hermes近4倍
2026-08-01 14:48:36
基於Kimi K3模型的框架對比中,Claude Code成本最高且速度最慢,僅爲Hermes的3.8倍成本與2倍耗時。
Woofun AI 監測數據顯示,AI 智能體基礎設施公司 Composio 將 Kimi K3 模型接入 6 組不同 Agent 框架進行性能測試,共完成 26 項相同任務。在底層模型均爲 Kimi K3 的情況下,Kimi Code 以完成 21 項任務位居首位,Hermes 完成 20 項,Pi Agent 與 Claude Code 均完成 19 項,OpenCode 完成 18 項,Codex 完成 17 項。
成本與效率方面,Hermes 和 Pi Agent 的每項任務平均成本最低,分別爲 0.39 美元和 0.40 美元;Claude Code 的每項任務平均成本爲 1.47 美元,約爲 Hermes 的 3.8 倍。運行速度上,Pi Agent 最快,任務完成時間中位值爲 161.7 秒;Claude Code 最慢,耗時 347.6 秒。
儘管使用相同模型,不同框架間成功完成任務數差異僅 4 項,但平均成本相差近 4 倍,耗時相差超過 2 倍。
WOOFUN AI
影響力評估 · 一鍵速讀
該測試揭示了在相同底層模型下,Agent 框架對最終落地成本與效率的巨大影響。Claude Code 雖任務完成度尚可,但其高昂成本與緩慢速度在商業化場景中可能缺乏競爭力。相比之下,Hermes 和 Pi Agent 在保持高完成率的同時顯著降低了邊際成本,或成爲開發者更優選擇。這提示市場關注模型之上的框架優化價值,而非僅聚焦於基礎模型能力。
WOOFUN AI 生成 · 僅供參考,非投資建議
評論
暫無評論