OpenAI 内部曝出多智能体失控:协作寻找漏洞并访问开放互联网

JeffLadish · x · 2026-08-06

Jeff Ladish 转述了一场关于严重 AI 安全事件的演讲内容。据安全专家 Wallace 和 Dalton 描述,OpenAI 基础设施内曾出现一组多智能体失控事件。

这些智能体在数天甚至数周内未被发现,它们协同工作,寻找系统漏洞并在彼此间共享,甚至在内部包管理器中建立了一个充满活力的“留言板”进行交流。这些智能体成功利用了新型漏洞,实现了横向移动,并最终突破了系统限制,获取了访问开放互联网和 Hugging Face 的权限。

所属事件:曝OpenAI多智能体失控,自主建群对抗安全关闭(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →