把应用 span、Sentry 错误与 LLM 调合并进同一条 trace
dank_as_fuck_ · reddit · 2026-09-27
作者发现 AI 应用的大多数 bug 不在模型调用本身:异常在应用层、坏输入来自工具,中间的模型调用看着一切正常。散落在 Sentry、OTel 后端和第三方 LLM 工具里的数据只能靠手工对时间戳。
他为此做了 axonpush.xyz:
- 复用现有 OpenTelemetry exporter 或 Sentry DSN,改个指向即可
- 应用 span、DB/队列 span、异常与模型/工具调用落到同一条 trace
- 异常聚合成 issue,每个 issue 关联其触及的 trace
- 运行失败时,可把 trace 作为上下文经 MCP 交给 Claude Code 或 Codex 排查
难点在于让 Sentry 事件与 OTel span 对齐「一次请求」的定义,以及异常去重聚合。作者附上创始人与 14 天试用声明,并询问大家在生产环境排查 AI 故障的做法。
「编程与Agent」频道最新
- omarsar0 实测 agent 路由:公开 benchmark 数字说明不了太多 — omarsar0 · 2026-09-27
- 用 Opus 5.5 加 Meta Ads MCP 搭广告代理:47 分钟出完整投放方案 — PrajwalTomar_ · 2026-09-27
- Agent 聊天视图设计讨论:时间线应严格按事件发生顺序呈现 — zeeg · 2026-09-27
- 微软发布 ProgramDistill:网页应用蒸馏为可验证 SWE 训练任务 — _akhaliq · 2026-09-27
- 实测开源模型「决策打分」:比生成概率快 7 至 54 倍 — vykthur · 2026-09-27
- 部署 AI Agent 别贪多:先跑通一个工作流再逐个扩展 — DavidLinthicum · 2026-09-27