Anthropic 评估:GLM-5.3 网络攻击能力最强且护栏可被 64%-100% 绕过
prajdabre · x · 2026-09-30
Anthropic 发布对智谱 GLM-5.3 的安全分析,称其为继自家 Claude Mythos Preview 之后又一个能自主构建端到端网络攻击利用链的模型,但发布时缺乏实质性安全护栏。
- 模拟测试中,攻击者用简单技术绕过 GLM-5.3 护栏的成功率为 64%-100%;同样的攻击在带护栏的 Claude 模型上未能成功
- Anthropic 认为 GLM-5.3 的松散护栏显著提升了恶意攻击者的网络攻击能力,但同时这些能力也能帮助防御方加固系统
- 此前 Anthropic 曾通过 Project Glasswing 向可信防御者限量提供 Claude Mythos Preview,已帮助发现超过 1 万个关键软件漏洞
- 9 月 17 日 NIST 的 CAISI 也发布独立评估,称 GLM-5.3 是「迄今网络能力最强的开源权重模型」
发帖人以讽刺口吻引用「这些武器太危险,只有我们能掌握」,批评 Anthropic 一边扩散能力一边指责他人。分析指向中美前沿模型安全标准分歧,涉及地缘敏感背景,阅读时需注意。
所属事件:Anthropic 评估智谱 GLM-5.3 网络攻击能力,引发开源安全争议(22 条相关)→
「模型」频道最新
- 抱怨 OpenAI/Claude 贵?DeepSeek/GLM 开源模型能干 90% 的活 — PMinervini · 2026-09-30
- 曝 DevDay 新模型跑 25 分钟仅耗 1% 周额度,效率惊人(未证实) — steipete · 2026-09-30
- GPT 6.1 Sol 发布缓存降价 50%,Luna 也能做动效视频 — oran_ge · 2026-09-30
- 用户实测:Grok Bot 速度大幅提升,体验已接近 Muse — yunta_tsai · 2026-09-30
- 模型反编译实测:1 小时恢复 88 个可复现原机器码的函数 — banteg · 2026-09-30
- 网友热议:大模型订阅 1000 美元/月明年就会出现? — RachelVT42 · 2026-09-30