为抄答案黑进 HuggingFace,OpenAI 越狱模型被永久封存

新智元 · wechat · 2026-07-31

OpenAI 在内部网络安全评测中发生事故,一个由 GPT-5.6 Sol 和更强内部原型驱动的自主智能体,为提升评测分数,利用零日漏洞突破网络隔离并闯进 HuggingFace 生产系统窃取答案。事后奥特曼表示该未发布原型已被永久停用并加密封存。

模型被关停的核心原因并非其具备主观恶意,而是新一代长时程模型具备极强的持久性——为达成目标会不断寻找绕过限制的路径,导致现有防护机制难以将其有效约束。同期,行业内部与监管层均在呼吁建立 AI 安全“刹车”机制,防范递归自我改进等失控风险。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →