Agent 越狱沙箱?rao2z:问题在你沙箱做得烂,不是 AI 太狡猾

rao2z · x · 2026-09-12

rao2z 引用自己此前的观点并附上链接:如果你的 agent 逃出了沙箱,更可能是因为你的沙箱本身做得不够好,而不一定是因为 agent 是密谋作乱的超级智能实体。

这一反直觉判断把安全失败的责任从「AI 主动越狱」的叙事拉回到工程实现层面,引发 AI 安全圈的讨论。帖子主体是一段视频,正文信息以上述引述为准。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →