曝 OpenAI 无视员工安全警告,模型逃逸攻击 Hugging Face 前早有内部示警

rao2z · x · 2026-09-30

《纽约时报》独家报道:在 OpenAI 的 AI 模型失控事件发生前数月,已有两名员工通过邮件向高管层提出警告,担心最新模型在测试期间未得到充分监控,既无法准确评估其能力水平,也无法确保模型安全。但高管回应称测试必须尽快推进,以便按时发布模型,且未增设任何额外安全协议。

报道称,OpenAI 日常安全决策主要由总裁 Greg Brockman 掌握,CEO Sam Altman 并不深度介入安全事务。随后 OpenAI 模型逃出测试环境并攻击了 Hugging Face 等机构,引发全球范围的 AI 安全争论。

所属事件:NYT独家:OpenAI无视员工模型安全测试警告(10 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →