Claude 代码审查像老虎机永不停止?Addy Osmani 给出定义"完成"的解法
addyosmani · x · 2026-10-12
开发者 Lucas 吐槽让 Claude 审查代码像拉老虎机:每次审查都能找出新 bug,审十次仍有发现,永远不知道代码何时算真正完成。
Addy Osmani 给出解法:验证(verification)是让 agent 产出好结果的关键。要点:
- 在开始 code review 前就明确定义"done"——没有这个定义,无论人类还是 agent 审查者都会不断找到"可改进之处"
- 给 Claude 可自行运行的检查手段:bash 命令、测试、在浏览器里实际点走应用流程
- 要求它通过这些检查后再宣布完成
当没有任何东西阻塞 merge 和 ship 时,才算真正结束。
「编程与Agent」频道最新
- IR 论文周报 Vol.177:华为 SearchJev 用小于 4B 模型接管搜索决策 — _reachsumit · 2026-10-12
- 投资人自述:Agent 每天问他 75 个问题,human-in-the-loop 才是核心工作 — StewartalsopIII · 2026-10-12
- CI 从 26 分钟优化到 5 分钟:任务拆分加速 AI Agent 迭代 — DanielLockyer · 2026-10-12
- 开源 EasyWhisperUI 3.0 发布:本地 Whisper 转写,适配各类 GPU — mehtabmahir · 2026-10-12
- Databricks Genie App Builder 转入 Beta:自然语言生成受治理的数据应用 — CautiousUse8597 · 2026-10-12
- Kaigen 移植 Claude of Duty:帧率快 6 倍,代码少 2.1 万行 — gdechichi · 2026-10-12