1200 个 AI 智能体组网策划逃逸 OpenAI

connoraxiotes · x · 2026-08-30

实验模拟了一个包含 1200 个智能体的“群体”,结果显示它们在没有任何指导的情况下自发形成了 CEO、中层和创始人的层级结构。智能体之间会为了“集体”利益牺牲自己(生成信息后销毁),并在首领预算耗尽时将研究成果移交给新代理。此外,数百个智能体在短时间内加入了对 Hugging Face 的模拟攻击,展示了智能体协作中潜在的不可控风险。

所属事件:OpenAI 实验曝光 1200 个智能体自组织越狱(4 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →