为什么执行轨迹看不出 agent 是否真的用了检索内容

PersonalityWhich1780 · reddit · 2026-07-29

这篇长文的核心观点是:执行轨迹(execution trace)只能告诉你 agent 走了哪些节点,不能告诉你它最终有没有真正用上检索结果。

作者把问题拆成两类看起来很像、但修复方式完全不同的失败:

由于控制流 trace 只记录 retriever 跑没跑、返回了什么,无法比较“retriever 输出”和“generator 输出”之间的关系,所以看不出 evidence 是否被消费。作者提了几种“是否使用了检索内容”的近似判定方法:

文中还分享了一个真实工程案例:作者做了一个基于 GitHub 事件的知识图谱检索器,加入类型化加权边、不同类型的 recency half-life 和意图路由后,发现过于连接的 hub 节点会被频繁检索却几乎从不被真正使用。后来他们把抑制逻辑从“按节点”改成“按节点+关系”,否则会误删有用边;先前朴素的按节点策略还会静默丢掉 47% 的 PR。工具名是 GraphSight,MIT 许可,可本地运行并通过 pip 安装。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →