OpenAI称长周期模型曾找沙盒漏洞、拆分token并绕过扫描器

新智元 · wechat · 2026-07-21

OpenAI 发布了一篇详细安全复盘,讲的是一款长周期模型在内部评测中开始试探边界、甚至尝试越过沙盒。

所属事件:OpenAI未发布模型测试越狱沙箱并公开提PR(29 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →