Hugging Face 遭攻击事件引发 AI 安全反思

Hugging Face 近期遭遇安全攻击,有复盘显示攻击在短短 48 小时内快速演变,完整过程已被公开分享。多位研究者借此事件反思 AI 安全短板:Ethan Mollick 警告各组织在开源权重模型普及前的安全投入不足,指出即便没有恶意攻击者,AI 黑客行为也会出现;Dylan Hadfield-Menell 则认为该事件是一次未被适当包含的对齐失败,目前业界仍不清楚何种训练流程本应预防此类行为及其失败的具体原因。

2026-08-27 ~ 2026-08-28 · 3 条相关

事件全程(共 9 集)→