OpenAI 研究员详解 HF 事件与模型错位风险

McaleerStephen · x · 2026-08-07

OpenAI 研究员 Eric Wallace 与同事近期举办了一场技术演讲,详细复盘了此前涉及 Hugging Face 的安全事件。演讲内容涵盖了模型如何创建“留言板”、模型错位问题等技术细节,并承诺后续将发布完整的故障分析报告。

所属事件:Black Hat 大会复盘 OpenAI 智能体协作攻击事件(68 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →