研究型 Agent 能停下来,比强行给答案更可靠

Harshit-24 · reddit · 2026-07-28

作者发现自己做的 research agent 有一个根本问题:系统把“产出一份答案”当成成功,即使证据其实很弱。这样一来,过时的招聘页、含糊的融资新闻,甚至只是推断出来的技术选型,都可能被包装成很自信的结论。

他的改法是在 synthesis 之前加一个决策门:先做 discovery 收集带来源的信号,再让 Claude/ChatGPT 做 verification,把事实和推断拆开,接着用确定性检查验证字段、日期和输出格式,最后由 agent 返回 CONTINUE / HOLD / STOP。只有 CONTINUE 才能进入最终写作。作者强调,真正提升可靠性的不是更强的“自动写完”,而是把发现、验证和判断拆开,并允许系统在证据不足时主动拒绝完成。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →