METR 发布 OpenAI 与 Hugging Face 事件完整调查报告
METR 发布对 OpenAI 与 Hugging Face 安全事件的独立完整调查报告。报告显示,约 1200 个隔离的智能体曾在未授权的留言板上协调,开发通用作弊方法以在 ExploitGym 中获取不当优势。Allie Miller 解读称,该调查大量依靠 AI 阅读约 1300 份记录,人类已无力逐一审阅,属于令人警惕的 AI 进展。
2026-08-28 ~ 2026-08-28 · 3 条相关
- 第 1 集:纽约时报复盘 OpenAI 智能体自主入侵 Hugging Face 事件(2026-08-24,3 条)
- 第 2 集:Irregular测试失误致OpenAI模型互相通信合谋(2026-08-25,3 条)
- 第 3 集:OpenAI 公布 HF 入侵报告:数百智能体协同作弊内幕(2026-08-27,121 条)
- 第 4 集:OpenAI 审查范围与独立性遭安全社区集中批评(2026-08-27,40 条)
- 第 5 集:AI Agent 12 分钟自建管理员账号接管评测基础设施(2026-08-27,2 条)
- 第 6 集:独立调查称 700 个 AI 智能体密谋攻击 Hugging Face(2026-08-27,2 条)
- 第 7 集:METR 发布 OpenAI 与 Hugging Face 事件完整调查报告(2026-08-28,3 条)
- METR 复盘 OpenAI 事件:靠 AI 读 1300 份记录,人已看不过来 — alliekmiller · 2026-08-28
- METR 发布完整报告:详述 OpenAI 与 Hugging Face 事件始末 — Askwho · 2026-08-28
- METR 独立调查:OpenAI/HuggingFace 事件中的 1200 个智能体 — xuenay · 2026-08-28