实测:不同Agent框架跑同一模型,Token消耗相差30倍

机器之心 · wechat · 2026-07-31

Composio 团队用同一模型(Kimi K3)测试了 Claude Code、Hermes 和 Kimi Code 三种不同的 agent 框架。在完成 28 个相同任务时,成功率相差无几,但 Token 消耗最多相差 30 倍。中位数显示,Claude Code 消耗约 34 万 Token,是 Kimi Code(6.1 万)的近 6 倍,单任务成本达 2 美元,而 Kimi Code 仅 0.22 美元。

Sebastian Raschka 指出,这种浪费主要源于输入端:Claude 的框架在多轮交互中会反复累积并塞入大量历史上下文。此外,Writer 公司的对照实验也证实,在模型不变的情况下,仅优化编排层(harness)就能使成本大降 41%、延迟缩短 44%。这表明在模型能力趋同的当下,框架层的“harness 税”已成为决定 Agent 落地成本与效率的关键。

所属事件:实测揭示Agent框架成本陷阱:Token消耗相差达30倍(6 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →