团队开始用不同模型家族做代码审查,专门抓盲点
desilvakai · reddit · 2026-07-24
两位创始人分享了一套跨模型家族的代码审查流程:一个 agent 负责写改动,另一个不同模型家族的 agent 负责 review,再加第三个模型做 adversarial pass,最后由人类结合测试套件和 CI 决定是否合并。
他们认为,review 的价值不在于“套了多少层 agent”,而在于 reviewer 和 writer 是否足够不同;如果只是同一个底座模型换个 reviewer prompt,往往只是在和自己观点一致。问题是成本很高:reviewer 每次都要重新拉分支、重跑测试、重建上下文,相当于再养一个独立大脑。作者也在问,大家有没有更便宜的做法。
「编程与Agent」频道最新
- 当机器写代码并验证正确性,Point-free 风格或许会回潮 — satnam6502 · 2026-07-24
- 让第二个模型审批工具调用,监督 agent 执行轨迹 — corbtt · 2026-07-24
- PRO-LONG 给 LLM agent 加可检索程序化记忆,ARC-AGI-3 提升 18 分 — dair_ai · 2026-07-24
- 用 CLI 把编码助手提示词抓成 git notes — rseroter · 2026-07-24
- 真人被反爬拦下,Codex 反而绕过了隐藏陷阱 — corbtt · 2026-07-24
- Kimi K3 登顶前端代码榜,设计盲测打平最强模型 — yuwen_lu_ · 2026-07-24