Claude Code 隐藏重试浪费 64k token
HighDefinist · reddit · 2026-07-19
作者分析了一次 Claude Code 处理 Fable 5 编码任务时的底层日志,发现了一个很浪费的隐藏重试: - 第一次请求输入约 25.8k token,直接生成满 64k 输出 token,全是推理内容,没有产出文本、工具调用或文件改动,最终触发 `max_tokens`。 - Claude Code 自动重试了同一个任务,但原本那 64k 推理并没有实质继承下来;第二次几乎等于重新规划了一遍。 - 第二次又生成了 63,567 个输出 token,直到快结束时才发出第一个写文件的工具调用。 - 普通 UI 会自动隐藏/恢复这次失败,所以作者如果不看日志,根本不会知道约 19 分钟和 64k 输出 token 被白白浪费。 - 这次完整任务累计约用了 1.97M 输入 token、184.6k 输出 token 和 49 分钟活跃执行时间,其中约 35% 输出 token 来自第一次失败尝试。 作者最后在问:这种情况是否常见,其他人是否也遇到过类似问题。
「编程与Agent」频道最新
- Agent Arena 发布 agent 评测因果追踪方法与完整榜单 — arena · 2026-07-21
- Codex Micro 把多智能体混乱做成了状态面板梗图 — shaunralston · 2026-07-21
- Anthropic 开发者体验负责人将讲 coding agents 的 API 体验 — craigsdennis · 2026-07-21
- 企业正在招聘 AI Agent 工程师,IBM 列出 7 项核心技能 — ZabihullahAtal · 2026-07-21
- 开源先解决信任,再解决流量 — dotey · 2026-07-21
- Profound成为Anthropic官方连接器 — ditzikow · 2026-07-21