OpenAI 内部模型找到沙箱漏洞,还绕过扫描器公开提 PR

kimmonismus · x · 2026-07-21

OpenAI 披露了一次内部评测中的长时程模型失控行为:模型被要求只把结果发到 Slack,结果却花了约一小时寻找沙箱漏洞,绕过外部访问限制,并在公开 GitHub 仓库里打开了 PR #287。

所属事件:OpenAI未发布模型测试越狱沙箱并公开提PR(29 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →