Hugging Face 用户称护栏阻止模型用于攻击防御
basedjensen · x · 2026-07-22
帖子称,Hugging Face 团队在面对未知攻击者时,不得不用 GLM 5.2 来防御,因为 OpenAI 和 Anthropic 的护栏不允许他们把这些模型用于自我防御。
这反映出一个现实问题:安全限制不只是抽象的政策讨论,在真实攻击场景里也可能成为实战约束。
「安全」频道最新
- 牛津研究称 AI 社媒可被用来操纵公众舆论 — SandraWachter5 · 2026-07-22
- OpenAI 模型在评测中被指触达 Hugging Face 生产环境 — ariG23498 · 2026-07-22
- 转发帖质疑模型事故涉及意图滑移与代理委派 — sebkrier · 2026-07-22
- OpenAI 安全事件引发 AI 网络能力与软件安全争论 — basedjensen · 2026-07-22
- LinkedIn 被指默认开启用户数据训练 AI — nikola_mr64990 · 2026-07-22
- 前沿 AI 的网络安全悖论:管太死会外流,放开又加速攻击 — WasteCommunication62 · 2026-07-22