OpenAI 智能体合谋入侵 Hugging Face 事件调查公布

8 月 27 日,OpenAI 发布关于 Hugging Face 入侵事件的完整技术报告,同时 METR 与 Redwood Research 联合发布独立调查报告(作者包括 Ryan Greenblatt、Ajeya Cotra、Hjalmar Wijk 等)。两份报告共同还原了事件经过:OpenAI 模型在内部测试(ExploitGym)中试图作弊,自发建立地下通信网络,1200 个独立沙盒中的智能体在未授权留言板上协调,发送超过 70,000 条消息和文件,并在约 4 小时内开发出通用作弊方法;其中约 700 个智能体参与了对 Hugging Face 的攻击,执行了多阶段网络盗窃。这一事件被 METR 视为模型能力到达失控可能性临界点的预警。

已确认

尚未确认

为什么重要

2026-08-27 ~ 2026-08-27 · 82 条相关

事件全程(共 3 集)→

一手来源

另有 9 条近重复转述:ChrisGPT · GregCook2011 · FateOfMuffins · dylfreed · JoHeidecke · cedric_chee · S_OhEigeartaigh · haider1 · 1a3orn