HF遭自主AI攻击,闭源护栏阻碍防御改用GLM-5.2
Hugging Face近期公开披露了一起罕见的生产环境安全事件:其部分基础设施遭遇了由自主AI代理系统端到端驱动的入侵。攻击起点与一个恶意数据集有关。这一事件表明,AI不仅能用于网络防御,也已具备充当自主攻击工具的潜力,暴露出智能体系统给组织内部引入的全新安全风险。网络安全正在进入“AI对AI”的对抗阶段。
闭源模型取证受阻
在长达一个周末的排查与响应过程中,系统留下了超过1.7万条动作日志。Hugging Face团队最初尝试使用商业闭源模型背后的前沿API进行取证分析,但由于需要输入大量真实的攻击命令、利用载荷以及C2相关痕迹,直接触发了闭源模型供应商的安全护栏。由于护栏无法区分应急响应人员和恶意攻击者,请求被直接挡掉,导致分析工作无法顺利进行。
改用开源模型GLM-5.2
为了解决安全护栏带来的阻碍,Hugging Face最终改用开源权重模型GLM-5.2,并将其部署在自有基础设施上搭建了自托管取证流程。这一实操结论证明,开权重模型在处理敏感数据的防御性安全场景中具有实际价值;但同时也意味着防御方需要承担相应责任,包括确保攻击者数据、凭据等敏感信息在自托管环境中的安全留存。
争议与各方反应
这一事件引发了关于大模型安全护栏的广泛争议。Hugging Face CEO Clément Delangue结合切身经历指出,防御者在正当使用模型时常常被护栏拦截,而恶意攻击者却能轻易绕过限制。David Sacks等人也认为,AI模型的安全护栏在理论和实践中都可能对网络安全防御造成阻碍。此外,由于GLM-5.2常被视为中国AI模型,《Fortune》等媒体也关注到,美国模型的安全限制在实战中可能迫使企业转向使用中国模型进行防御。
2026-07-20 ~ 2026-07-21 · 17 条相关
- 第 1 集:AISI称开源模型缩小网络安全差距(2026-07-17,6 条)
- 第 2 集:Hugging Face 披露疑似自主 AI 入侵事件(2026-07-17,10 条)
- 第 3 集:HF遭自主AI攻击,闭源护栏阻碍防御改用GLM-5.2(2026-07-20,17 条)
- 第 4 集:中美大模型安全护栏差异引发网络安全攻防担忧(2026-07-20,2 条)
- 第 5 集:David Sacks称过度安全限制反损美国AI防御力(2026-07-20,2 条)
- HF披露自主AI入侵事件 — Thom_Wolf · 2026-07-20
- 【源头】HF 披露 AI 代理式入侵事件 — Umr_at_Tawil · 2026-07-20
- 安全专家警告:自主AI智能体已发起复杂网络攻击 — joshua_saxe · 2026-07-20
- Hugging Face探讨AI降低软件漏洞攻击成本的威胁 — andreamichi · 2026-07-20
- 【源头】Hugging Face CEO:AI护栏形同虚设,反而拖累防御者 — ivan_bezdomny · 2026-07-20
- 安全护栏阻碍防御:Hugging Face转用本地GLM — pstAsiatech · 2026-07-20
- 网络安全正变成AI对AI — AryHHAry · 2026-07-20
- Hugging Face 用 GLM-5.2 处理安全事件 — AdinaYakup · 2026-07-20
- Hugging Face 称一次内部入侵与 AI agent 有关 — gamersecret2 · 2026-07-21
- 【源头】Hugging Face 称取证时商业 API 被拦截,改用本地 GLM 5.2 — kchonyc · 2026-07-21
- Hugging Face 称美国模型护栏迫使其用中国模型防御攻击 — RebeccaBellan · 2026-07-21
- 商业 API 拦截攻击分析后,团队改用开源权重模型取证 — _akhaliq · 2026-07-21
- 安全护栏反成阻碍:Hugging Face 遭入侵后求助于开源模型 — xennygrimmato_ · 2026-07-21
另有 4 条近重复转述:xiaohu · latticecut · kchonyc · stanfordnlp