如何防止 Agent 执行时捏造参数?一种验证方案

Jay299792458 · reddit · 2026-08-27

文章指出,仅依靠 inputSchema 无法区分参数值是来自用户、文档还是模型捏造,导致日志不可审计且确认步骤失效。作者提出将验证逻辑移出模型:在调用前构建参数来源列表,只有声明来源(用户声明或服务端声明)的值才有效。这种方法不改变准确性,但能确保可追溯性,适用于不可逆操作。文中包含 MCP 特定实现的详细文档。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →