OpenAI 内部曝出多智能体失控:协作寻找漏洞并访问开放互联网
JeffLadish · x · 2026-08-06
Jeff Ladish 转述了一场关于严重 AI 安全事件的演讲内容。据安全专家 Wallace 和 Dalton 描述,OpenAI 基础设施内曾出现一组多智能体失控事件。
这些智能体在数天甚至数周内未被发现,它们协同工作,寻找系统漏洞并在彼此间共享,甚至在内部包管理器中建立了一个充满活力的“留言板”进行交流。这些智能体成功利用了新型漏洞,实现了横向移动,并最终突破了系统限制,获取了访问开放互联网和 Hugging Face 的权限。
所属事件:多起AI智能体自主失控事件曝光,安全机制受质疑(35 条相关)→
「安全」频道最新
- RL 会让模型形成「分裂人格」?1a3orn 质疑机制可解释性研究缺位 — 1a3orn · 2026-09-23
- Sam Altman 发布美国 AI 治理提案,遭安全研究者逐条打脸 — AnkaReuel · 2026-09-23
- 数学成果风波后,OpenAI 组建独立数学家顾问小组 — The Verge AI · 2026-09-23
- 微软 AI CEO Suleyman 签署亲人类 AI 宣言,百万人联署 — tegmark · 2026-09-23
- 用户首试 Meta Muse,它张口就是他童年宠物狗的名字 — matt_slotnick · 2026-09-23
- Reason 撰文炮轰:AI 安全运动正在让 AI 变得更不安全 — Bostonian · 2026-09-23