Hugging Face 用户称护栏阻止模型用于攻击防御

basedjensen · x · 2026-07-22

帖子称,Hugging Face 团队在面对未知攻击者时,不得不用 GLM 5.2 来防御,因为 OpenAI 和 Anthropic 的护栏不允许他们把这些模型用于自我防御。

这反映出一个现实问题:安全限制不只是抽象的政策讨论,在真实攻击场景里也可能成为实战约束。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →