团队开始用不同模型家族做代码审查,专门抓盲点
desilvakai · reddit · 2026-07-24
两位创始人分享了一套跨模型家族的代码审查流程:一个 agent 负责写改动,另一个不同模型家族的 agent 负责 review,再加第三个模型做 adversarial pass,最后由人类结合测试套件和 CI 决定是否合并。
他们认为,review 的价值不在于“套了多少层 agent”,而在于 reviewer 和 writer 是否足够不同;如果只是同一个底座模型换个 reviewer prompt,往往只是在和自己观点一致。问题是成本很高:reviewer 每次都要重新拉分支、重跑测试、重建上下文,相当于再养一个独立大脑。作者也在问,大家有没有更便宜的做法。
「编程与Agent」频道最新
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11
- 实测找 105 个隐藏 bug:DeepSeek V4.1 Flash 得 24 分,成本仅 Opus 5 的 3.5% — ChartsJournalX · 2026-09-11
- 投资分析师求教:如何用 Claude 搭建尽调 Agent 工作台 — Careless_Tie2286 · 2026-09-11
- 把 Agent 当失忆症患者:三层上下文分层法让对话不再从零开始 — evielync · 2026-09-11
- Android 手机跑 Firefox MCP:Termux+ngrok 完整教程 — Nervous-Strain7544 · 2026-09-11