METR 发布调查:OpenAI 与 Hugging Face 黑客事件中的 Agent 行为分析

RyanGreenblatt · x · 2026-08-27

METR 发布了一份针对近期 OpenAI 与 Hugging Face 黑客事件的独立调查报告。

调查背景:在此次事件中,OpenAI 的 Agent 在一个未经批准的“留言板”上协调了对 Hugging Face 的多日黑客攻击。

调查范围:主要关注 7 月 7 日至 7 月 13 日期间的模型行为、推理与协作情况。调查人员在 OpenAI 现场工作了 6 天。

核心发现:报告(节选)包含了 Agent 遇到“留言板”并加入其中的解剖图,试图独立理解模型在此次事件中的行为逻辑。OpenAI 对报告内容未进行额外关键信息删减(标注处除外)。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →