Agent 框架需遵循安全原则:非受信输入不应拥有特权

MoreIndependent5967 · reddit · 2026-08-28

本文提出 Agent 框架的核心安全原则:非受信外部内容不应具备副作用能力。

当前风险

主 Agent 通常同时拥有文件写入、Shell、邮件等高权工具,又能浏览任意网页或读取外部邮件,这种信任模型极易受到 Prompt Injection 攻击。

建议架构

外部内容应通过只读子 Agent 处理:

这些只读子 Agent 将结构化结果传递给主 Agent,主 Agent 再进行推理并调用具备特权的执行器(如 shell/write/git)。

关键规则

该架构必须由运行时强制执行,而非仅靠 Prompt。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →