审查者+批评家架构胜出,小团队代码审查新范式

rohanpaul_ai · x · 2026-08-24

论文提出“对抗性审查”架构:代码冻结后,由审查者撰写意见,批评家进行审计,仅将定稿返回修改。研究发现,简单增加 Agent 往往导致错误共识,关键在于引入规则:要求异议必须基于代码证据而非直觉。在 LiveCodeBench 上,3 Agent 版本达 87%(优于 5 Agent 的 82%);在 PR 审查中,强制代码证据规则使 F1 从 0.457 提升至 0.533。

所属事件:研究:对抗式多智能体代码审查胜过堆数量(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →