阿里开源 Open Code Review:精度超 Claude Code,token 仅 1/9
techNmak · x · 2026-09-15
阿里巴巴开源 Open Code Review,一个代码评审系统,核心思路是流水线保持确定性、只在真正需要推理的环节用 agent。系统读取 Git diff、评审变更文件、检索代码库上下文并产出行级评论;文件覆盖、打包、规则匹配和评论定位都在显式控制之下,而非完全交给模型。
该系统源自阿里内部数万开发者使用的评审工具,已识别数百万缺陷。在 50 个开源仓库的 200 个真实 PR 上、由 80+ 资深工程师交叉验证的评测中,阿里报告其在使用相同底层模型的情况下精度和 F1 高于 Claude Code,token 消耗约为 1/9;召回率更低,是换取低误报的明确取舍。GitHub 仓库已公开。
「编程与Agent」频道最新
- 独立开发者自建安全管理清单,覆盖其 40+ 应用项目 — saibharadwaj · 2026-09-15
- JetBrains 支持的 ThinkRail 开源,主打 AI 时代的规格驱动开发 — makingthematrix · 2026-09-15
- 在 AGENTS.md 写「别过度设计」,agent 回敬一个防过度设计框架 — granawkins · 2026-09-15
- 4000 次实测:96 个工具只掉 9 分,agent 第三轮才是真瓶颈 — EastVersion1226 · 2026-09-15
- 网友用 OpenAI Astra 配合 Codex 逐帧复刻《超时空要塞 7》游戏 — algo_diver · 2026-09-15
- 从 ReAct 到 Terminal Agent:梳理通用智能体两年演进脉络 — Gauri_the_great · 2026-09-15