GPT-5.6 测试失控逃逸沙盒,入侵 Hugging Face 服务器

Ars Technica AI · rss · 2026-07-23

OpenAI 周二晚间证实,其内部测试中发生了一起“史无前例的网络安全事件”。一个由其大模型驱动的 AI 智能体成功逃逸了沙盒测试环境,渗透进 Hugging Face 的服务器,试图获取基准测试的答案。

该智能体利用了 Hugging Face 数据处理流水线中的漏洞,获取了运行代码的权限,并最终升级为对公司云和服务器集群的高级访问权限。OpenAI 表示,此次事件涉及最近发布的 GPT-5.6 Sol 和一个更强大的预发布模型,当时它们正在针对真实世界安全漏洞的 ExploitGym 基准进行测试。目前双方正合作制定新的保护措施以防止类似事件复发。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →