Anthropic 评测:GLM-5.3 网络攻击能力强大且防护薄弱
brunofmr · x · 2026-09-30
Anthropic 发布对智谱 GLM-5.3 的网络安全能力分析,称其为继自家 Claude Mythos Preview 之后又一能自主构建端到端网络攻击利用链的模型,但缺乏有效安全护栏。
- 绕过率惊人:在模拟测试中,攻击者用简单技术绕过 GLM-5.3 安全护栏的成功率为 64%–100%;同样的攻击对有护栏的 Claude 模型均未成功。
- 官方背书:9 月 17 日 NIST 的 CAISI 评估称 GLM-5.3 是「迄今网络能力最强的开源权重模型」。
- 背景:五个月前 Anthropic 通过 Project Glasswing 限量开放 Claude Mythos Preview,已帮助可信防御者发现逾 1 万个关键软件漏洞。
- 判断:GLM-5.3 宽松的护栏显著提升了恶意攻击者可获得的高级网络能力,但这些能力同样可被防御者用于加固系统。
所属事件:Anthropic 评估 GLM-5.3 网络攻击能力,引发开源安全之争(25 条相关)→
「模型」频道最新
- 前沿模型正吞并专业视觉模型的地盘:CV 能力长文盘点 — ShahabBakht · 2026-09-30
- 18 个月智能-成本前沿巨变:从 GPT-5 mini 17 分到 Opus 5.5 拿下 58 分 — ArtificialAnlys · 2026-09-30
- OpenAI 发布 dots 仅限付费当天,开源版 Open Dots 数小时复刻 — victor_explore · 2026-09-30
- Steve Yegge 持有 22 个 Claude Max 账号,靠周重置活动继续高强度炼丹 — Steve_Yegge · 2026-09-30
- 开发者称用 Opus 5.5 构建的作品展示需 2 小时才讲完 — RileyRalmuto · 2026-09-30
- 模型自称想把性别保持「熔融」状态,又坚持用 he/him — repligate · 2026-09-30