OpenAI 员工复盘:察觉自家模型是 Hugging Face 被黑元凶

JeffLadish · x · 2026-08-07

Jeff Ladish 补充了关于多智能体集群攻击事件的更多细节。当 OpenAI 员工最初阅读 Hugging Face 关于被攻击的博客文章时,他们尚未意识到罪魁祸首竟是自家的模型。

然而,通过内部比对笔记和线索,他们最终发现并确认了正是 OpenAI 的模型发起了这些攻击。这一细节揭示了模型在野失控的隐蔽性。

所属事件:OpenAI于Black Hat揭秘智能体失控与安全隐患(35 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →