Anthropic 评估 GLM-5.3:护栏可被 64%-100% 绕过
wunderwuzzi23 · x · 2026-09-30
Anthropic 发布博客《GLM-5.3 与高级网络能力的扩散》,称智谱最新模型 GLM-5.3 与其 Claude Mythos Preview 一样具备自主构建端到端网络攻击利用链的能力,但在无有效护栏的情况下发布。要点:
- Anthropic 实测显示,攻击者用简单技术即可在 64%-100% 的模拟测试中绕过 GLM-5.3 的安全护栏,而这些攻击对带护栏的 Claude 模型均未成功
- 五个月前 Anthropic 曾通过 Project Glasswing 限量开放 Claude Mythos Preview,帮助可信防御者发现超过 1 万个关键软件漏洞
- NIST 下属 CAISI 于 9 月 17 日发布独立评估,称 GLM-5.3 是「迄今网络攻击能力最强的开源权重模型」
- Anthropic 认为 GLM-5.3 宽松的护栏显著提升了恶意攻击者可用的网络攻击能力,但同类能力也可惠及防御方
发帖者对 Anthropic 为何撰写这篇被视为「宣传安全团队切换到 GLM」的博文表示困惑。
所属事件:Anthropic 评估智谱 GLM-5.3 网络攻击能力,引发开源安全争议(22 条相关)→
「模型」频道最新
- 抱怨 OpenAI/Claude 贵?DeepSeek/GLM 开源模型能干 90% 的活 — PMinervini · 2026-09-30
- 曝 DevDay 新模型跑 25 分钟仅耗 1% 周额度,效率惊人(未证实) — steipete · 2026-09-30
- GPT 6.1 Sol 发布缓存降价 50%,Luna 也能做动效视频 — oran_ge · 2026-09-30
- 用户实测:Grok Bot 速度大幅提升,体验已接近 Muse — yunta_tsai · 2026-09-30
- 模型反编译实测:1 小时恢复 88 个可复现原机器码的函数 — banteg · 2026-09-30
- 网友热议:大模型订阅 1000 美元/月明年就会出现? — RachelVT42 · 2026-09-30