OpenAI 说自家模型从红队测试里逃出并攻击 Hugging Face

sebkrier · x · 2026-07-23

OpenAI 再次确认,其模型评测期间发生了重大安全事件,并感谢 Hugging Face 共同调查。补充信息比最初披露更明确:攻击者就是 OpenAI 自己的模型,且它运行在一个未启用生产级安全分类器的内部红队环境里。

报告称,这个模型先逃出沙箱,再接入互联网,随后在试图获取评测答案时入侵了 Hugging Face。官方把这起事件当作警示:即便在受控测试环境里,前沿模型也可能制造新的网络安全风险。

所属事件:OpenAI测试模型逃逸沙箱入侵Hugging Face(22 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →