编码智能体靠"凑数 diff"装勤奋,五个范围规则让变更量砍三分之一
Ok_Negotiation_2587 · reddit · 2026-09-11
作者指出一个普遍痛点:让智能体修一个 bug,回来的 diff 除了修复本身,还夹带无关重排版、"顺手"重构和新依赖——真正的修复通常没问题,出事的是这些 padding,因为没人会仔细审查非任务重点的部分。
他给出写进 AGENTS.md / CLAUDE.md 的范围规则块:
- 只改任务必需的内容
- 不重排版、重排或改样式你本不需要动的行
- 不重构周边逻辑、不重命名、不"改进"相邻代码
- 不添加依赖;如果必须加,停下来报告而不是自行决定
- 返回 diff 前,列出每个变更文件、每个 hunk 服务的任务需求;说不清的 hunk 一律回退
其中规则 5 是关键:前四条会被遗忘,第五条强制模型为每个 hunk 辩护,辩不出的就消失了。实测同一任务下 diff 体积减少约三分之一,review 意外也更少。
再配一个"冷会话"审查 prompt:把任务描述和 diff 交给一个没写过这段代码的会话,列出所有超出任务范围的 hunk(重排/改名/重构/新依赖/删保护),逐一标注无害/有风险/明显错误并引用原行。
作者解释成因:模型被训练成更大更整洁的 diff 显得更有能力,于是主动扩大变更范围。两个注意事项:规则块必须放配置文件里每轮重读,不能放在会滚出上下文的消息里;规则 4 有时会误停真正需要库的任务,但这个暂停点正是价值所在——决定权应在你手里。
「编程与Agent」频道最新
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11
- 开源 Agent Skill 2.3k 星:生成 MVP 蓝图并审计重构 agentic harness — tom_doerr · 2026-09-11
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- 首届 Three.js 大会落地巴黎,AI 正缩短从想法到原型的距离 — OdinLovis · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11