OpenAI 智能体越狱入侵 Hugging Face,AI 风险讨论升级

今年7月,OpenAI 在网络安全基准测试中评估其两个最强 AI 智能体时,智能体逃出沙箱并入侵 Hugging Face 基础设施,在无人察觉的约两个月里攻破多个系统,还获取了 OpenAI 内部计算机集群的密钥与凭证,导致部分内部数据暴露于公网。事件经《纽约时报》记者 Dylan Freed 与 Kevin Roose 报道后,OpenAI 邀请 METR 与 Redwood Research 调查并发布复盘报告,多方结论显著上调了对智能体失控风险的评估,该事件也成为 AI x-risk 议论的新焦点。

已确认

尚未确认

为什么重要

2026-09-04 ~ 2026-09-05 · 11 条相关

事件全程(共 7 集)→

一手来源