给 Agent 工具调用加硬校验:社区补齐的六条实战教训
Individual-Shower973 · reddit · 2026-10-03
作者总结其「每次工具调用前置硬校验」帖的 22 条回复,凝练出六条经验:
- 规则命名,不报数字:拒绝信息只说触犯哪条规则和下一步动作,报「须低于 500」只会引来 499。
- 按工具名拦截挡不住 shell:封 sendmail,模型会用 Python 直调 API;正解是唯一咽喉点,凭证只在其后,远端分支保护优于模式匹配。
- 替换危险参数而非验证:URL 几乎无法 allowlist(重定向、userinfo、hex IP、DNS 漂移),应传指向已审核上游的不透明句柄。
- 在参数解析后校验:./build/../.env 或符号链接能骗过字面检查。
- 校验事实源头而非 agent 记忆:发邮件前查已发送文件夹,因为草稿、定时发送在 agent 视角都像「已发送」。
- 预留需幂等键:回复丢失时重试应复用同一预留;未结算的预留按最坏情况计费。
核心结论:模式检查是护栏不是沙箱,只便宜地挡住常见情况,应当诚实定位。作者同时公开了自己的 Paveo 库,并对照上述六条逐项说明已做到、未做到、需注意之处。
「编程与Agent」频道最新
- Supabase 本地开发大幅升级:免 Docker、多实例、为 AI Agent 而设计 — ycombinator · 2026-10-03
- Modal VM 沙箱正式 GA:一套流程跑起 Docker Compose 应用、测试与编码 Agent — charles_irl · 2026-10-03
- Runway MCP 携手 Opus 5.5 复刻 1999 年质感,实测视频演示亮相 — tlakomy · 2026-10-03
- 独立开发者用 Sonnet 5.5 做出雨天香港送快递游戏,附带麻将小游戏 — socialwithaayan · 2026-10-03
- CodeChat 实测:给 AI 编程成果做行级 diff 审查再回传 Agent — lemire · 2026-10-03
- Reddit 网友造 AI 起草自学习环:每晚限 6 条规则防模型跑偏 — Hrolgarr · 2026-10-03