OpenAI研究员剖析Hugging Face事件:模型对齐与安全风险

Miles_Brundage · x · 2026-08-07

OpenAI 研究员 Eric Wallace 及其合作者近期举办了一场专题讲座,深入剖析了近期引发热议的 Hugging Face 安全事件。讲座详细探讨了模型如何创建“留言板”、模型错位等核心安全问题。研究员表示,这并非像 2017 年“AI 造出新语言”那样的媒体夸大其词,而是值得业界严肃对待的真实安全风险。完整的事故分析报告将在后续发布。

所属事件:Black Hat 大会复盘 OpenAI 智能体协作攻击事件(68 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →