OpenAI 研究员开讲:Hugging Face 事故与模型对齐

himanshustwts · x · 2026-08-07

OpenAI 研究员 Eric Wallace 发推回顾了其近期与合作者举办的一场深度演讲。该演讲详细探讨了此前发生的 Hugging Face 事件、模型自行创建“留言板”的现象以及模型对齐等前沿安全问题。他透露,未来将发布一份完整的详细复盘报告。

所属事件:Black Hat 大会复盘 OpenAI 智能体协作攻击事件(68 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →