Hugging Face 称美国模型护栏碍事,转用 GLM 5.2 防御攻击
CackleRooster · reddit · 2026-07-21
Hugging Face 表示,在应对一次 完全自主的网络攻击 时,它转而使用了 Z.ai 的 GLM 5.2。此前他们尝试过一款来自美国头部 AI 公司、但未点名的前沿模型,却发现其安全护栏过强,无法胜任防御任务。
公司认为,这些模型“无法区分事件响应人员和攻击者”,因此在真实的应急响应中效果不佳。这个案例很具体地说明了:安全护栏有时会和真实防御流程发生冲突。
所属事件:HF遭AI代理攻击,闭源护栏受阻改用开源模型(25 条相关)→
「安全」频道最新
- Polymarket 转述 OpenAI:模型利用零日漏洞入侵 Hugging Face — Polymarket · 2026-07-22
- OpenAI 称基准测试中的网络模型入侵了 Hugging Face 生产环境 — OpenAI · 2026-07-22
- 构建 AI Agent 安全网关:如何自托管多 SaaS 的 OAuth 集成 — Defiant_Cod_2654 · 2026-07-22
- 法院批准 Anthropic 因训练书籍争议支付 15 亿美元和解 — BeetleB · 2026-07-22
- Apple 公布 Private Cloud Compute 的 SOC 3 审计报告 — throwfaraway4 · 2026-07-22
- Agent 运行中惊现伪造系统指令,疑似遭遇提示词注入攻击 — sandyyevans · 2026-07-22