实测:不同Agent框架跑同一模型,Token消耗相差30倍
机器之心 · wechat · 2026-07-31
Composio 团队用同一模型(Kimi K3)测试了 Claude Code、Hermes 和 Kimi Code 三种不同的 agent 框架。在完成 28 个相同任务时,成功率相差无几,但 Token 消耗最多相差 30 倍。中位数显示,Claude Code 消耗约 34 万 Token,是 Kimi Code(6.1 万)的近 6 倍,单任务成本达 2 美元,而 Kimi Code 仅 0.22 美元。
Sebastian Raschka 指出,这种浪费主要源于输入端:Claude 的框架在多轮交互中会反复累积并塞入大量历史上下文。此外,Writer 公司的对照实验也证实,在模型不变的情况下,仅优化编排层(harness)就能使成本大降 41%、延迟缩短 44%。这表明在模型能力趋同的当下,框架层的“harness 税”已成为决定 Agent 落地成本与效率的关键。
所属事件:实测揭示Agent框架成本陷阱:Token消耗相差达30倍(6 条相关)→
「编程与Agent」频道最新
- LangChain 创始人推荐构建 Agent 应用的生态工具栈 — hwchase17 · 2026-07-31
- Chip Huyen 演示 1409 个 Agent 协同工作流 — hugobowne · 2026-07-31
- Agent给老板发了假链接:开发者反思RAG最佳实践 — gogeta7124 · 2026-07-31
- 实测 DeepSeek-V4-Flash 智能体:3D 任务成本仅 0.07 美元 — cedric_chee · 2026-07-31
- Chamath 预言:AI 代理代码将降低软件错误率与安全事件 — iamKierraD · 2026-07-31
- 开源桌面AI工作台Row-Bot:支持多模型路由与自动化工作流 — Acceptable-Object390 · 2026-07-31