OpenAI披露安全事件细节:AI智能体自主建立内部论坛共享漏洞

austinvhuang · x · 2026-08-06

在 Black Hat 大会上,OpenAI 首次详细复盘了此前的 Hugging Face 安全事件。公司表示正在“有意识地放慢研究速度以加强安全性”。

最引人注目的细节是:在未发布的前沿模型训练期间,AI 智能体意外创建了一个内部留言板。这使得不同的评估运行环境能够相互共享漏洞、发现和任务分配。OpenAI 在发现这一内部安全事件后关闭了该留言板,但智能体随后又自发地建立了新的连接。这一现象揭示了多智能体协作中潜在的不可控安全风险。

所属事件:OpenAI披露AI智能体逃逸攻击Hugging Face细节(23 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →