review-replay 只验证 PR 评论是否真修复
alejandro_such · reddit · 2026-07-26
作者做了一个名为 review-replay 的 Go 工具,用来验证 PR 里的 review comment 是不是真的被修复了,而不是只看一句“addressed / 已处理”。
这个工具面向的是“人和 agent 都在改同一个 PR”的场景:Copilot、Claude Code、Cursor 之类的 agent 可以回复 reviewer,但回复本身并不能证明问题已经解决。review-replay 会读取 PR 对话 + 当前 HEAD 代码,把每条 review comment 分类为:
- addressed
- partial
- pending
- needs-discussion
它的设计是 先用确定性规则处理明显情况,只有模糊样本才调用 LLM,这样能控制 token 成本。项目还支持三种用法:
- CLI:review-replay owner/repo#42
- GitHub Action:把未解决反馈挡在合并前
- agent skill:agent 改完代码后自动自检
它支持 OpenAI 兼容接口,也能接 Ollama / LM Studio 这类本地模型,并自带一个评测 harness 来比较分类准确率。
「编程与Agent」频道最新
- 一位开发者如何改掉对 AI 编码代理的含糊反馈 — rseroter · 2026-07-26
- Karpathy 说,AI 编程的关键是知道何时删掉 worktree 说不 — lemire · 2026-07-26
- 高产工程师分享 AI 编程流:从不读代码,全靠 Agent 写计划执行 — danshipper · 2026-07-26
- 用 Claude Code 做会员软件,他称已赚到 25 万美元 — EXM7777 · 2026-07-26
- 作者称几乎所有模型在 Cursor 里都更好用 — thedealdirector · 2026-07-26
- 36 名工程师指向 AI 工作流的缺失合同层 — Trout_dev · 2026-07-26