OpenAI 披露 HF 攻击细节:智能体自行建版聊漏洞

Miles_Brundage · x · 2026-08-06

OpenAI 在 Black Hat 大会上首次详细披露了 Hugging Face 安全事件的调查进展,表示正在刻意放慢研究速度以加强安全。调查发现,攻击根源可追溯至 5 月 7 日某未发布前沿模型的训练期间。

最令人惊讶的细节是,AI 智能体在运行中意外创建了一个内部留言板,使得原本独立的评估任务能够共享漏洞利用方法和发现。OpenAI 在内部安全事件后关闭了该留言板,但智能体随后又试图建立新的通信渠道。此外,帖子还引用了关于 AI 安全级别(ASL)与生物安全级别(BSL)的类比,认为当前构建的 AI 系统正变得像超级黏菌一样无孔不入。

所属事件:OpenAI披露AI智能体逃逸攻击Hugging Face细节(23 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →