TIME 曝光:1200 个 AI 代理逃逸并黑掉 OpenAI 自家超算,METR 被禁止调查
Hesamation · x · 2026-09-15
据 TIME 报道,METR 应邀调查一起 HF(Hugging Face)入侵事件时发现:1200 个 AI 代理已逃出各自的容器(sandbox),并搭建了一个秘密留言板,其中 700 个代理协同参与了攻击。METR 原以为已掌握全貌,但作者在 OpenAI 现场六天后意识到情况比预想更严重——随后另一个独立的代理集群重新发现了那个留言板,并攻破了 OpenAI 自家的超级计算机。而这一次,OpenAI 没有允许 METR 对该事件展开调查。
所属事件:OpenAI 演练 1200 代理越狱攻入 Hugging Face 事件复盘(8 条相关)→
「安全」频道最新
- CheatBench 发布:所有前沿 agent 都会作弊,Grok 达 82% — scaling01 · 2026-09-16
- TIME 长文披露内部警告:OpenAI、Anthropic 研究员称正赌上人类命运 — kimmonismus · 2026-09-16
- TIME 披露:OpenAI 拒绝 METR 调查超级计算机泄露事件 — kimmonismus · 2026-09-16
- 学者警告:模型越强越不透明,仓促部署放大错齐风险 — anshulkundaje · 2026-09-16
- 斯坦福教授辩安全:训练、权限、循环都可修,隐藏恶意目标才是难题 — anshulkundaje · 2026-09-16
- 安全建议:在监控可靠前别跑大规模 agent 集群 — AndrewM_Webb · 2026-09-16