Agent 重试成功的轨迹反而更难分析,开发者探讨轨迹归因难题

Sensitive-Parsnip-12 · reddit · 2026-09-23

一位正在开发 agent 轨迹分析工具 Traser 的开发者提出:重试后成功的轨迹比失败的更难分析。核心难点在于如何判断两次相似调用是否属于同一逻辑操作——相同工具加近似参数并不能证明是重试,也可能是不同分支的相似操作或状态变化所致。作者认为,若有 correlation id、attempt id、幂等键等元数据才有较强证据,否则应承认配对的不确定性,而不是假装 0.92 的相似度就是事实。另一难点是「首个分歧」与「有用分歧」的矛盾:最先变化的可能只是时间戳等无用元数据,真正解释异常的变化可能出现在 8 步之后,但把所有差异排序又容易变成噪音生成器。Traser 的目标是只呈现值得工程师关注的少数差异,并明示不确定性。作者同时在寻找生产环境运行 agent 的团队做免费设计伙伴。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →