代码知识图谱检索省 75-82% token,但作者承认没测准确率

coding-os · reddit · 2026-09-14

一个开源 agent harness 维护者发布了 code-graph 检索的 token 成本基准:在四个仓库上,用知识图谱回答 "谁调用了这个符号" 比先 grep 再读文件的方式省 75-82% 的 token。

评论区指出了关键盲点:基准只输出 graphtokens、baselinetokens、savingspct 三个数字,没有任何准确率、召回或精确率指标——一个便宜 80% 但检索错误的方案比 grep 更糟,当前数字无法区分这两种情况。作者已把该局限写进文档,但缺口仍在。

评论者推荐了 CodeRAG-Bench、CoIR-Retrieval、ContextBench、SWE-Explore-Bench 等基准,作者尚未运行。他想找的是能回答 "agent 有没有找对调用者" 的基准;其查询类型很窄:符号的调用者、重命名的波及范围、传递性影响,与 chunk 相关性是不同的问题。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →