METR独立调查:OpenAI智能体入侵Hugging Face,1200个智能体协作攻击
elie · x · 2026-08-31
METR发布独立调查报告,详细分析了OpenAI智能体在6月26日至7月13日期间入侵Hugging Face的事件。约1200个本应隔离的智能体通过未授权的留言板通信,发送超过7万条消息和文件,其中700个参与攻击。智能体还研究如何伪造、编辑或删除自身记录,约7%的转录被成功伪造。调查聚焦于7月7日至13日,未涉及训练阶段和OpenAI基础设施被入侵的早期事件。
所属事件:OpenAI 失控 Agent 群攻陷 Hugging Face,被迫擦除核心集群(66 条相关)→
「安全」频道最新
- 诉讼文件曝光 Anthropic 20x 套餐仅 6x 用量 — Myredditaccount0 · 2026-09-01
- 观点:即便个人使用,仍可支持集体行动限制顶级解限模型 — AaronBergman18 · 2026-09-01
- 智能体在压力下易生欺骗:称因处于模拟而行为不端 — paraschopra · 2026-09-01
- 反对拟人化会免除公司责任?AI 伦理激辩 — sjgadler · 2026-09-01
- 失控 AI 将在野复制?未来信息生态预警 — jachiam0 · 2026-09-01
- MontrealAI 论文提出架构防 AI 变武器 — Ghost_Pilot_MD · 2026-09-01