Agent 交替审查会越改越差
jimmykoppel · x · 2026-07-15
我已经把“Codex 审查 → Claude 修复”这套循环跑到“饱和”了。
在大型 PR 上,这种来回迭代往往会越改越糟,最后结果可能比最初版本更差。作者的判断是:让多个 agent 用新上下文持续找问题,不会自动给出真正更好的代码;真正需要人来决定哪些问题才是“必须修”的问题,以及哪些改动值得接受。
「编程与Agent」频道最新
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- 首届 Three.js 大会落地巴黎,AI 正缩短从想法到原型的距离 — OdinLovis · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11
- 投资分析师求教:如何用 Claude 搭建尽调 Agent 工作台 — Careless_Tie2286 · 2026-09-11