OpenAI 内部安全人员:Agent 风险「不只是沙箱」那么简单

FateOfMuffins · reddit · 2026-09-29

一位自称 OpenAI 内部安全人员的观点在 Reddit 引发关注:原话是「不只是那个该死的沙箱(It's not just the fcking sandbox)」。

帖主转发其 X 帖子,指向 AI agent 安全部署的核心争论:仅靠沙箱隔离并不足以应对 agent 的安全风险,还有更多层面的威胁模型需要考虑。具体论证需看原推,但这条内部视角发言触及了 agent 安全工程中被广泛讨论的盲点。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →