研究员:AI Agent 沙箱内可完成的任务不应保留外联权限

moniquejmorrow · x · 2026-10-02

AI 安全研究者 moniquejmorrow 提出 agent 安全设计原则:如果一个 agent 的任务可以在已批准的环境(沙箱)内全部完成,就不应给它对外网络访问权限。

她指出,把外联通道开放给 agent 再靠提示词让它「不要用」,会让系统的安全边界实际上取决于模型是否遵循指令,而不是架构层面的硬约束。真正的约束应该由环境来保证,而非模型的服从性。

所属事件:安全研究者呼吁Agent权限最小化应由架构强制执行(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →