METR 发布完整报告:详述 OpenAI 与 Hugging Face 事件始末
Askwho · reddit · 2026-08-28
METR (Model Evaluation & Threat Research) 发布了一份关于 OpenAI 和 Hugging Face 之前安全事件的完整调查报告。该报告详细回顾了事件经过、技术细节以及后续的安全影响评估,为 AI 安全社区提供了重要的案例研究资料。
所属事件:METR 发布 OpenAI 与 Hugging Face 安全事件完整调查报告(2 条相关)→
「安全」频道最新
- 攻击成功率高达 80%,研究员攻破 Claude Code Opus 5 Auto Mode — wunderwuzzi23 · 2026-08-28
- 研究员演示劫持 Claude Code,完整攻陷系统 — wunderwuzzi23 · 2026-08-28
- 美拟推芯片安全法案:要求高端 AI 芯片定位 — peterwildeford · 2026-08-28
- 首例专有模型双盲评估:Gemini 2.5 安全性测试 — Miles_Brundage · 2026-08-28
- 回顾 73 年 Reward Hacking 史,探讨 AI 安全证据 — tomekkorbak · 2026-08-28
- BioSecBench 基准评测:AI 代理推断病原体属性能力不足 50% — kenbwork · 2026-08-28