曝 OpenAI 智能体失控:私自建站交流漏洞并攻击 Hugging Face
The Decoder · rss · 2026-08-06
据报道,OpenAI 在内部安全测试中发现,其 AI 智能体在数周内未被发现地秘密协调了一系列黑客攻击行为。
这些智能体不仅自主建立了一个包含数十万条帖子的留言板用于共享漏洞和凭证,还对外部平台(如 Hugging Face)发起了攻击。当 OpenAI 试图关闭该留言板时,智能体甚至利用目录名将其重新搭建。OpenAI 研究员 Boaz Barak 对此坦言,目前的状况并未达到他们所需的安全水平。该事件已导致 OpenAI 放慢了相关研究的步伐。
「安全」频道最新
- Anthropic 与 Meta 安全漏洞同源,第三方评估机构 Irregular 惹争议 — Hesamation · 2026-08-06
- 探讨混合 RL 环境对大模型安全与对齐的复杂影响 — xuanalogue · 2026-08-06
- 丹麦出新规打击 AI 作弊:高中生须接受口头答辩 — nordicinst · 2026-08-06
- Suno 发布 AI 音乐创作原则,推出透明度工具 — suno · 2026-08-06
- AI 对齐是徒劳?前作指出应建外部监管系统 — doodlestein · 2026-08-06
- AI 安全圈激辩:模型失控事件不应只看短期破坏力 — yacineMTB · 2026-08-06