MCP 工具调用护栏实践
Background-Job-862 · reddit · 2026-07-16
作者复盘了一次“几乎执行破坏性数据库查询”的 MCP 工具调用事故:代理在歧义指令下构造了可能 drop table 的调用,虽然最终被权限检查拦下,但这更多是运气而非设计。
文章将护栏分成两类:
- Pre-tool checks:在请求到达 MCP server 前,检查参数是否不仅“schema 合法”,还是否“策略合法”,例如拦截破坏性 SQL、限制特定表/路径、扫描参数中的密钥或 PII,并做与调用者权限绑定的硬权限校验。
- Post-tool checks:工具返回后、结果回传给 agent/用户前,扫描是否包含不该出边界的 PII/密钥,对要展示给终端用户的内容做审核,必要时可以选择脱敏而不是完全阻断。
作者强调,真正关键的是哪些检查必须在请求路径里同步阻断/脱敏,哪些可以作为异步日志/告警跑,不要给每次调用都增加不必要的延迟。文中还提到他们在 MCP gateway 上用 Truefoundry 的 guardrails 规则链分别处理 block、redact、flag、pass,并且已经抓到过真实问题。最后作者反问:其他团队的 pre/post-tool checklist 是否已形成共识,还是仍在各自摸索。
「编程与Agent」频道最新
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11