Prompt injection 已是信息流问题,多数 Agent 框架还当内容过滤来防

lucasbennett_1 · reddit · 2026-10-01

作者指出 agent 生态的防御思维仍停留在「内容层」——更强的系统提示、更好的过滤器、在模型看到前拦截恶意字符串,但真实工具型 agent 的风险早已转移到「信息流」层面。核心问题不是「这个网页是否恶意」,而是「不可信来源是否影响了特权参数」:一个页面安全可摘要,但其中的文本若决定了邮件收件人或数据库工具的参数,就会出事。

论证要点

自查问题:对每个 agent 可触达的写工具,问它验证的是「用户请求了这个动作」还是「agent 有权调用」——后者全是隐患。

社区在尝试的方案

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →