Anthropic 安全研究者:Agent 权限最小化须靠架构,不能靠提示词

moniquejmorrow · x · 2026-10-02

Anthropic 安全研究者 Monique Morrow 提出 agent 部署的核心安全原则:提示词可以定义任务和塑造预期行为,但"最小权限"必须由周边架构强制执行。她的判断标准是:部署 agent 前先问它完成这个任务实际需要哪些访问权限,其余一切应保持不可用。如果 agent 的任务完全可以在批准的环境内完成,就不应开放外向访问——保持端口开放然后"要求 agent 别用",等于把遏制安全寄托在模型对指令的服从上。

所属事件:安全研究者呼吁Agent权限最小化应由架构强制执行(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →