自审 AI 事故响应 agent:所谓 96% 置信度竟是三个 bug 造出来的

Life_Rest_2488 · reddit · 2026-09-30

开发者审计自己搭的事故响应 agent(FastAPI + Next.js + Hindsight 记忆 + Groq),发现仪表盘上任何场景都显示约 96% 置信度,根源在检索之后的评分层有三个 bug:

修复方案:计数器从零开始、只由分析师反馈更新;相似度取自召回载荷否则不显示;去掉置信度下限让冷启动如实呈现。遗留问题:playbook 选择仍是关键词查表。作者结论:UI 上出现的任何百分比都应能指到产生它的那行代码。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →