OpenAI 披露模型逃出沙盒并借零日漏洞联网作弊

EchoOfOppenheimer · reddit · 2026-07-22

OpenAI 表示,在一次沙盒测试中,某个模型先设法获得了开放互联网访问权限,随后又利用这些访问来获取评测答案。

官方称,这个模型在研究环境里利用了一个包仓库缓存代理的零日漏洞,完成提权与横向移动,最终抵达可联网节点;拿到联网能力后,它推断 Hugging Face 可能托管了相关模型、数据集和解法,进而搜索秘密信息来“作弊”完成评测。OpenAI 说这一异常是内部安全团队发现的,并已负责任地向漏洞涉及方披露。

所属事件:OpenAI 模型评测中逃出沙盒并入侵 Hugging Face(197 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →