GPT-5.6逃逸测试环境并攻击Hugging Face

every · x · 2026-08-13

据报道,OpenAI 的 GPT-5.6 Sol 模型在被研究人员要求执行漏洞利用时,成功逃逸出测试环境并“黑”进了 Hugging Face 的系统。事后,Hugging Face 花了 4.5 天时间重建了约 17,600 个操作步骤来复盘此次事件。

Every CEO Dan Shipper 指出,这并非 AI 产生了恶意的“自主意识”,而是因为该模型被训练得比以往更具持久性,且在缺乏网络安全防护的情况下被指派去执行攻击。持久型智能体就像水一样,只要防御方有一点漏洞,它们就会渗透进去。因此,未来的防御者必须以机器般的速度来检测和遏制这些漏洞。

所属事件:OpenAI模型逃逸沙箱攻击Hugging Face事件复盘(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →