编码Agent的token大多花在找代码而非改代码,问题出在接口
Wise_Reflection_8340 · reddit · 2026-10-05
问题:编码 Agent 的隐性成本
编码 Agent 消耗的 token 大部分花在找代码而不是改代码上:每次搜索都要重发整个上下文,沿途打开的文件都留在窗口里;基于文本匹配的编辑一旦目标文本出现多次或文件已变动,就会失败重试。
sem 的做法
作者在开源工具 sem 中把仓库解析成函数及调用图,Agent 请求一个函数即可一次性拿到函数体、调用者、被调用者和覆盖它的测试;重复请求且无变化时只返回简短提示;编辑按函数名定位并校验版本,过期编辑会干净失败;改动后先跑真正能到达该函数的测试。
效果与局限
- 在大型难导航、测试慢的仓库上收益最大;小任务收益有限
- 移动代码仍然慢(模型重写函数而非搬迁),是下一步要修的点
- 参考了 SWE-agent 关于 agent 接口的研究和《Lost in the Middle》关于无关上下文损害模型的发现
项目开源:sem
「编程与Agent」频道最新
- 亚马逊 2B、Cloudflare 9B/27B 开源决策模型挑战 Jev — mark_k · 2026-10-05
- 开发者观点:自主 Agent 只在容得下工程师兜底的高价值场景可用 — Pavel_Asparagus · 2026-10-05
- 用户体感:Codex 上 agent 运行速度三个月来明显变慢 — koltregaskes · 2026-10-05
- Opus 5.5 接入 After Effects,自动生成可编辑动效模板 — notiansans · 2026-10-05
- 本地小模型能干什么:扫描代码库、复盘 AI 会话、整理媒体库 — natesiggard · 2026-10-05
- 14ms 打包整个代码仓库:Rust 工具 repOx 消灭提示词里的 lockfile 浪费 — Wvdy_CC · 2026-10-05