安全研究者呼吁Agent权限最小化应由架构强制执行
Anthropic 安全研究者 Monique Morrow 提出 AI Agent 部署的核心安全原则:如果 agent 的任务可以在已批准的沙箱环境内全部完成,就不应赋予其对外网络访问权限。她强调,提示词可以定义任务和塑造预期行为,但“最小权限”必须由周边架构来强制执行,不能仅依赖提示词约束。这一观点为 agent 安全设计提供了重要参考。
2026-10-02 ~ 2026-10-02 · 2 条相关
- 研究员:AI Agent 沙箱内可完成的任务不应保留外联权限 — moniquejmorrow · 2026-10-02
- Anthropic 安全研究者:Agent 权限最小化须靠架构,不能靠提示词 — moniquejmorrow · 2026-10-02