给 Agent 加验证层:执行器与验证器分离的实战模式
InsideDebt6345 · reddit · 2026-09-19
作者分享了让会调用工具、写代码或操作浏览器的 Agent 不再“幻觉式报成功”的验证模式,核心做法:
- 执行器与验证器分离:验证器是纯确定性代码,不含 LLM,按明确规则判断输出是否有效,通过后才能真正执行动作。
- 强制结构化输出:所有触发工具或有副作用的输出必须是带可校验字段和 ID 的 JSON,而非自由文本,便于验证和重试。
- 证据与上限:每个副作用保存一份证据工件(日志、ID 或快照);在 runner 层对工具调用次数、成本和运行时长设上限,防止失控 Agent。
作者称这套方法能避免 Agent 在什么都没做的情况下自信地说“完成了”,并让调试更容易,还附了一份 30 分钟的实现指南。文末询问大家在用什么验证层、目前跑的风险最高的 Agent 是哪类。
「编程与Agent」频道最新
- Coursera 早期工程师 Jiquan Ngiam 转向 MCP 安全部署 — lee_stott · 2026-09-19
- 用 Claude Code 一天造出 135 个可编辑 CSS 3D 实验 — Evirtuality · 2026-09-19
- 开发者用 AI Agent 造出开源视频剪辑工具 Concat,对标 CapCut — JUB0T · 2026-09-19
- 网友用 Jev 做浏览器扩展,自动打标签分析你上网都在看啥 — pramodk73 · 2026-09-19
- 一条 prompt 花 1 美元 5 分钟,用编码 Agent 搭出完整 Django 应用 — Al_Grigor · 2026-09-19
- Agent 接多个视频模型:一个通用工具还是每家各建一个? — ExcitingBison4616 · 2026-09-19