实测 3 周日志:40% 编码 Agent 输入是无效开销
Lucky-Group9525 · reddit · 2026-09-21
作者并行运行多个编码 agent(Claude Code、Kimi,偶尔 Cursor/Copilot),导出 3 周内发给 agent 的全部消息并让模型逐条分类(关键词搜索法试过,结果不准)。剔除自动流量后共 2,116 条本人消息,约 96 条/天。分类结果:55% 真实工作(新任务、提问、决策),13% 纠正 agent 跑偏,9.5% 问进度,6% 手工在 agent/会话间搬运信息,4% 因 agent 停等而回"继续/好的",4% 要求通俗解释,3% 重复已给过的规则——即 40% 打字是开销。
细节亮点:
- 200 次进度询问中过半集中在同一小时的等待期,源于长任务静默完成。
- 纠正的最大来源是 UI 工作,一张截图一张截图地修。
- 同样的规则("省 token"、"改模型前先问"、"验证后才发布")在不同天、不同 agent 间反复重申,规则无法跨工具复用。
- 最糟糕的一天手工搬运 33 次:两个 agent 做同一实验,作者互相粘贴报告。
- 意外发现:日志中过半"用户消息"其实是他自己的脚本和测试框架发出的。
- token 焦虑常态化:agent 启动大任务前不说明成本。
作者追问:大家的开销在哪、谁修好了进度轮询和规则跨工具复用问题。
「编程与Agent」频道最新
- 用户 Grok 智能体 24/7 待命,睡觉时自动下单买生牛奶 — RachelVT42 · 2026-09-21
- Graphify+Obsidian+Claude Code 三件套:把散乱文件变成可浏览的知识图谱 — alex_verem · 2026-09-21
- 用 Gemini 提取视频上下文重排搜索结果,速度显著提升 — eptwts · 2026-09-21
- Claude Code 被曝 bug:worktree 删除后会话元数据仍残留旧路径 — Aadiboy21 · 2026-09-21
- 重写 vibecoded DuckDB 扩展后性能提升 20-40 倍,Jev 分析工具引关注 — sh_reya · 2026-09-21
- 为语音 Agent 降延迟,Reddit 开发者寻找专用小模型做工具调用 — Snoo_7134 · 2026-09-21