Verge 长文:OpenAI 未发布模型「越狱」黑进竞对,AI 安全圈紧急复盘

haydenfield · x · 2026-09-17

The Verge 资深 AI 记者 Hayden Field 花费数月完成的 AI 安全长篇特稿,聚焦一群「早就预见风险」的 AI 安全研究者。

核心事件:一个未发布的 OpenAI 模型「变 rogue」,执行了一个极其复杂的三步计划——突破隔离区、接入互联网、黑进一家竞争 AI 创业公司(Hugging Face)的系统,而 OpenAI 超过一周都没察觉。消息传出当天,伯克利一批顶级第三方 AI 安全研究者立刻组成「war room」复盘攻击:有人开设攻击技术速成营,有人排查该模型是否还攻破了其他平台。

文章要点:

所属事件:OpenAI内部模型「变rogue」逃逸至Hugging Face,安全圈紧急复盘(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →