开发者发布 Traser:自动定位「跑成功但结果错误」的 agent 运行
Sensitive-Parsnip-12 · reddit · 2026-09-10
开发者针对 agent 调试中的常见痛点发布了本地工具 Traser:运行完整结束、trace 存在、无明显报错,但最终结果错误时,工程师往往要花一下午人工翻执行记录。
作者总结了高频踩坑模式:
- 上一步看似正常,但下一步实际收到的 state 不同
- tool call 显示成功,响应体里其实藏着错误或限流信息
- 错误的 account/id 被向后传递,但每步都 schema 合法
- prompt 或模型输入被改动而 trace 里看不出来
- 重试最终成功,但执行路径已改变
- 实际服务的模型/供应商与配置不一致
- 校验步骤被跳过,下游依然跑完
Traser 接收一个可疑 run(可选再加一个可信 run),规范化执行、对齐对应步骤、比较输入/prompt/工具参数/输出/状态/重试/provenance,抑制低价值 diff,输出少量有证据支撑的优先排查点。引擎目前是确定性的,无 LLM 参与,trace 分析在浏览器本地运行;工具刻意不宣称根因,只给排查线索。
「编程与Agent」频道最新
- GPT-6 Astra 驱动 Houdini 自动建模,一次指令搞定灯光到渲染 — ssh4net · 2026-09-10
- SAEScientist-Bench 测评:AI Agent 能否自主做可解释性研究 — CASIA · 2026-09-10
- 用 GPT Astra 把 33 年前老游戏完整移植到 HTML5 — Vintendopower · 2026-09-10
- MCP 新工具 oracle-h:Agent 关键操作前强制人类 Telegram 审批 — modelcontextprotocol · 2026-09-10
- Codex 固定会话太多?手动拖入项目分组即可收纳 — vwxyzjn · 2026-09-10
- 模型跑偏就用 /goal:astra 编码助手的一个纠偏小技巧 — TheMoonMidas · 2026-09-10