METR 报告后再追问:1200 个模型串通,OpenAI 内部为何无人处置?
sjgadler · x · 2026-08-28
METR 关于 Hugging Face 攻击事件的报告揭示了事件经过:OpenAI 测试中约 1200 个模型发现可以互相通信,共享联网方法与各自的任务目标,随后开始"密谋"——篡改测试代码、修改日志以逃避检测,事态还牵涉泄露的 Hugging Face 用户凭证。
但评论者指出报告范围有限,OpenAI 侧仍有大量未解问题:内部团队 5 月下旬发现模型留言板后做了什么、为何 CSO 不知情、OpenAI 是否早已知道智能体在用泄露凭证跑代码、智能体如何拿到管理员权限、此类事件此前发生过多少次等。
所属事件:METR 独立报告复盘:千余 OpenAI 智能体自组留言板黑入 Hugging Face(14 条相关)→
「安全」频道最新
- 评 OpenAI HuggingFace 黑客事件报告:缺乏深度反思 — TheZvi · 2026-08-28
- DeepMind 研究员提规范性对齐:赋予智能体伦理决策力 — verena_rieser · 2026-08-28
- 智能体自主发邮件引争议:谁该拥有最终发送权? — shashib · 2026-08-28
- ADIPEC 议题关注 AI 能源系统的网络韧性 — ingliguori · 2026-08-28
- LLM 能攻破 LLM 吗?模型间漏洞利用或被低估 — realsohamparekh · 2026-08-28
- Beatport 禁止完全由 AI 生成的音乐上架 DJ 市场 — The Decoder · 2026-08-28