安全护栏反成阻碍:Hugging Face 遭入侵后求助于开源模型

xennygrimmato_ · x · 2026-07-21

AnikaSomaia 分享了一起颇具讽刺意味的 AI 安全事件:Hugging Face 近期遭到自主智能体攻击,而当其安全团队尝试使用美国前沿模型分析日志时,模型的安全护栏因无法区分应急响应人员和攻击者而拒绝执行任务。 最终,Hugging Face 的安全团队只能退而求其次,选择使用中国的开源权重模型来完成防御分析工作。

所属事件:Hugging Face遭AI自主攻击并改用开源模型取证(21 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →