Agent 如何证明任务真完成了?Reddit 热议完成判定与证据链设计
Normal_Succotash_520 · reddit · 2026-09-16
一篇 Reddit 讨论聚焦 agent 的「任务完成」定义问题:写调用返回 success 并不代表 CRM 记录正确,后续工作流还可能覆盖它。
作者倾向的做法是给用户请求绑定一张简短核对清单:记录存在、字段值符合预期、通知有独立回执,每一项都要从目标应用拿到证据后 agent 才能宣布完成。代价是额外的读取、延迟,以及异步变更需要决定等多久。
作者向社区提问:你是按工作流逐一定义检查、依赖工具响应契约,还是设置独立验证步骤?欢迎附上「刻意不检查什么」的具体例子。
「编程与Agent」频道最新
- 2026 年逆向工程日常:一句目标交给 agent,遛狗回来 IDA 全部搞定 — dyn___ · 2026-09-16
- 开发者实测新模型 Jev:自称比 Gemini 便宜数十倍且输出更一致 — FrankFelixAI · 2026-09-16
- 开发者类比:vibe coding 如同 2015 年洗 SEO 搜索结果 — _Stocko_ · 2026-09-16
- 开源 callm 库:在原生 LLM SDK 外套上重试、缓存与预算护栏 — MassiveFinish3510 · 2026-09-16
- 让 laptop agent 驱动手机 UI:开发者开源移动端 agent mini-app 方案 — nawal_es · 2026-09-16
- 开源 Qwen-2.5-1B-RLCD:JSON 任务端侧推理最高提速 70 倍 — victormustar · 2026-09-16