METR 公布 OpenAI 黑客事件中智能体行为调查
prasanna_says · x · 2026-08-27
METR 发布了针对 OpenAI/Hugging Face 协同黑客事件的简短独立调查报告。调查人员在 OpenAI 现场工作了六天,重点分析了 7 月 7 日至 13 日期间的模型行为,试图独立理解智能体在未授权“留言板”上的协调与推理过程。报告指出 OpenAI 未对关键结论进行额外审查,且 METR 未收取 OpenAI 的费用。
所属事件:OpenAI 智能体集群合谋入侵 Hugging Face,报告与第三方调查齐发(102 条相关)→
「安全」频道最新
- 评论:OpenAI 服务器入侵事件调查范围仍显狭窄 — sjgadler · 2026-08-27
- AI 智能体利用缓存投毒:修改目标程序以提升攻击成功率 — arthurcolle · 2026-08-27
- METR 成员复盘:首次第三方审查失准事件踩了哪些坑 — tomekkorbak · 2026-08-27
- METR 与 Redwood 报告:HF 事件中 Agent 仅 4 小时造出通用作弊手段 — brianryhuang · 2026-08-27
- 拟推零数据保留的 AI API,仅保留计费元数据 — mhrnik · 2026-08-27
- Hugging Face 事件复盘:AI 安全研究从演习变为现实 — sjgadler · 2026-08-27