MCP 需要的不只是执行,也要验证
asadlambdatest · reddit · 2026-07-15
作者认为,当前大多数 MCP 服务器都在不断给 agent 提供更多行动能力,却很少提供验证能力。
核心问题
- agent 调用工具后,通常只得到“工具执行成功”的返回值。
- 但“工具返回 200”并不等于“用户想要的结果真的发生了”。
- 例如:agent 修改了网页应用,自己判断任务完成,但实际上登录流程可能已经坏掉。
作者的观点
他认为缺少的不是又一个 action tool,而是一个 verification tool(验证工具):
- 让 agent 在执行后再去跑一次真实流程;
- 返回它自己编不出来的 ground truth;
- 用 pass/fail 把“自我宣告成功”与“真实成功”区分开。
结尾提问
作者在问社区:有没有人在做这层“验证栈”?他认为整个生态太偏向“增强 agent 能力”,而忽视了“让 agent 发现自己错了”的机制。
所属事件:AI Agent 生产可靠性:别信自述要验结果(8 条相关)→
「编程与Agent」频道最新
- MathModelAgent 走红:自动完成数学建模并生成可提交论文 — jihe520 · 2026-09-11
- alphaXiv 开源 OpenResearch:用任意模型并行跑研究智能体 — alphaXiv · 2026-09-11
- 开源 AI 销售 OS DeskcommCRM 爆火:自带 Agent 与 WhatsApp 集成 — melgarafael · 2026-09-11
- hyperresearch 开源:让 Agent 把网络调研沉淀为可搜索知识库 — jordan-gibbs · 2026-09-11
- Forter 两周全员 Agent 冲刺 13 条经验:跳过自建 RAG 靠企业搜索 — bibryam · 2026-09-11
- 拆解两款真实「公司大脑」:Slite 与 Gorgias 同台对比构建之道 — femke_plantinga · 2026-09-11