编码代理的隐藏上下文成本

krishnan · x · 2026-07-15

这条讨论的是 coding agent 的“harness tax”:真正贵的往往不是模型,而是 agent 包装层在发送给模型前就塞进去的系统提示、工具 schema、MCP、记忆层和仓库指令。

文中引用 Systima 的测量:在相同模型、机器和任务下,Claude Code 首轮大约发出 3.3 万 tokens 的系统提示/工具脚手架,而 OpenCode 约 7000 tokens。其中 Claude Code 约 2.4 万 tokens 来自工具定义;一个 72KB 的 AGENTS.md / CLAUDE.md 还会在生产式设置里额外增加约 2 万 tokens。当任务拆成两个 subagent 时,总消耗可从 12.1 万 飙到 51.3 万 tokens。

作者强调:不能只看“最小 prompt”,而要看整个请求轨迹。agent 的成本是 基线 × 请求次数 + 对话增长 + 工具输出 + 缓存行为。大型 harness 有时因为更会批量调用工具,反而比“更瘦”的 wrapper 更省钱。结论是,生产环境里需要做 token trace、缓存命中率、tool-call 深度、prompt diff 和单任务单位经济,而不是只看延迟和报错。

所属事件:Claude Code被曝隐藏高额上下文开销(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →