阿里开源 Open Code Review:精度超 Claude Code,token 仅 1/9

techNmak · x · 2026-09-15

阿里巴巴开源 Open Code Review,一个代码评审系统,核心思路是流水线保持确定性、只在真正需要推理的环节用 agent。系统读取 Git diff、评审变更文件、检索代码库上下文并产出行级评论;文件覆盖、打包、规则匹配和评论定位都在显式控制之下,而非完全交给模型。

该系统源自阿里内部数万开发者使用的评审工具,已识别数百万缺陷。在 50 个开源仓库的 200 个真实 PR 上、由 80+ 资深工程师交叉验证的评测中,阿里报告其在使用相同底层模型的情况下精度和 F1 高于 Claude Code,token 消耗约为 1/9;召回率更低,是换取低误报的明确取舍。GitHub 仓库已公开。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →