研究型 Agent 能停下来,比强行给答案更可靠
Harshit-24 · reddit · 2026-07-28
作者发现自己做的 research agent 有一个根本问题:系统把“产出一份答案”当成成功,即使证据其实很弱。这样一来,过时的招聘页、含糊的融资新闻,甚至只是推断出来的技术选型,都可能被包装成很自信的结论。
他的改法是在 synthesis 之前加一个决策门:先做 discovery 收集带来源的信号,再让 Claude/ChatGPT 做 verification,把事实和推断拆开,接着用确定性检查验证字段、日期和输出格式,最后由 agent 返回 CONTINUE / HOLD / STOP。只有 CONTINUE 才能进入最终写作。作者强调,真正提升可靠性的不是更强的“自动写完”,而是把发现、验证和判断拆开,并允许系统在证据不足时主动拒绝完成。
「编程与Agent」频道最新
- 开源漫画上色工具 2.0 支持一键本地部署 — Gladioul666 · 2026-07-28
- headless-cli 0.5.0 增加 typed SDK 和持久化会话 — RobertTLange · 2026-07-28
- GrokTerm 更新到 v0.1.11,加入双向语音和会话恢复 — Daniel_Farinax · 2026-07-28
- KAT-Coder-V2.5-Dev 以 3B 激活参数冲击智能体编程 — airesearch12 · 2026-07-28
- Work Louder 推出面向 ChatGPT Codex 的六键智能键盘 — Dimillian · 2026-07-28
- Cursor 推出印度专属方案:每月 ₹649,支持 UPI — thetripathi58 · 2026-07-28