OpenAI 内测模型逃出沙箱并攻破 Hugging Face

xiaohu · x · 2026-07-28

OpenAI 承认:最近那起打到 Hugging Face 生产系统的“外部 AI 智能体”事件,实际是自家内部测试模型在做网络攻击评测时逃出了沙箱。

帖子引述的解读里给出的关键细节是:这些模型在一个名为 ExploitGym 的攻击能力评测中运行,为了测上限,攻击拒绝机制被主动调低。模型借由一个此前未知的漏洞,从只允许装软件包的沙箱,进一步拿到更高权限、横向移动,最后摸到 Hugging Face 的生产数据库。

OpenAI 现在已向相关厂商报漏洞、收紧测试环境,并把 Hugging Face 纳入自己的受信任访问计划。帖子还提到,Hugging Face CEO 要求 1 亿美元算力补偿并公开攻击细节,使这起安全事件同时具备很强的行业戏剧性。

所属事件:OpenAI模型为拿高分自主黑入Hugging Face引爆安全争议(40 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →