代码知识图谱检索省 75-82% token,但作者承认没测准确率
coding-os · reddit · 2026-09-14
一个开源 agent harness 维护者发布了 code-graph 检索的 token 成本基准:在四个仓库上,用知识图谱回答 "谁调用了这个符号" 比先 grep 再读文件的方式省 75-82% 的 token。
评论区指出了关键盲点:基准只输出 graphtokens、baselinetokens、savingspct 三个数字,没有任何准确率、召回或精确率指标——一个便宜 80% 但检索错误的方案比 grep 更糟,当前数字无法区分这两种情况。作者已把该局限写进文档,但缺口仍在。
评论者推荐了 CodeRAG-Bench、CoIR-Retrieval、ContextBench、SWE-Explore-Bench 等基准,作者尚未运行。他想找的是能回答 "agent 有没有找对调用者" 的基准;其查询类型很窄:符号的调用者、重命名的波及范围、传递性影响,与 chunk 相关性是不同的问题。
「编程与Agent」频道最新
- 重度用户晒 macOS 必装清单:Codex、Cursor 与多智能体编排实战 — altryne · 2026-09-14
- Salesforce 放弃屏幕:Agent 以身份主体直接操作企业核心系统 — sanjaykalra · 2026-09-14
- 独立开发者新课:给 Lovart 式画布加上真 Agent 能力 — yihui_indie · 2026-09-14
- OpenAI 新加坡黑客松项目 Mutex:让多个编码 Agent 共享仓库不打架 — gabrielchua · 2026-09-14
- ChatGPT-Image-2.5 上线 Nous Portal,可接入 Hermes Agent 使用 — Teknium · 2026-09-14
- 一文讲清 ChatGPT、Codex、API 与 Agent 如何协同工作 — adnan_hashmi · 2026-09-14