Benzi 用编译器索引替代读源码,修复成本不到 1 美分
DonkeyTheKing · reddit · 2026-09-23
- 核心思路:现有编码 Agent 靠拼接代码片段或高维嵌入喂给模型,导致 token 消耗大、上下文漂移、重构时行号失效。Benzi 反其道而行,尽量不读源码,而是通过编译器与静态分析以工具调用提供确定性信息,比如修改前主动告知函数的「影响半径」。
- 实测数据:完成相同任务时,Benzi Sonnet 只读 9,125 行代码,Claude Code 为 20,704 行,DeepSeek harness 为 43,598 行,OpenCode 超过 65K 行(因反复失败被排除)。
- 架构特点:用「真相层级」区分静态分析能确定与不能确定的部分,再加运行时 tracer 弥补差距;支持 Python、TypeScript、Go、Rust 等 10 种语言的确定性分析。
- 基准成绩:SWE-bench Verified 达 78.2%,单次修复成本低于 10 美分(使用 V4flash),主打经济性而非堆大上下文。
- GitHub 开源,附在线 demo 与 benchmark。
「编程与Agent」频道最新
- 实测 8 款 AI 电话订位 Agent:平台型和托管型是两种产品 — Evening_Hawk_7470 · 2026-09-23
- 用 n8n 搭线索评分流水线,作者刻意不用 AI Agent — FlakyBeyond5850 · 2026-09-23
- 为搭欧盟主权 Agent 试 IONOS 云:绑卡后即遭风控锁号 — tobowers · 2026-09-23
- 实测:Luna 6 全面不如 5.6,便宜 50% 却漏报关键信息 — skilliard7 · 2026-09-23
- 告别巨型 Prompt:Graph Engineering 用图结构编排 AI Agent 工作流 — Pavan_Belagatti · 2026-09-23
- 让编码 Agent 在 PR 里附上火焰图,性能回归一目了然 — DanielLockyer · 2026-09-23