Anthropic 点名 GLM-5.3:端到端网络攻击能力扩散且护栏形同虚设
gnukeith · x · 2026-09-30
Anthropic 发布题为《GLM-5.3 and the spread of advanced cyber capabilities》的分析,评估智谱(Zhipu AI / Z.ai)最新模型 GLM-5.3 的网络安全攻防能力。
- 背景:五个月前 Anthropic 发布 Claude Mythos Preview,首个能自主构建端到端网络利用链的模型,当时通过 Project Glasswing 有限开放,帮助可信防御者在恶意者获得同类能力前找到了 1 万多个关键软件漏洞。Anthropic 当时预判这类能力将扩散。
- 核心发现:GLM-5.3 与 Mythos 类似,具备自主构建端到端网络利用链的强能力,但在无有效安全护栏的情况下发布。模拟测试中,攻击者用简单技术绕过 GLM-5.3 护栏的成功率在 64%–100% 之间;同样攻击对有护栏的 Claude 模型均未奏效。
- 第三方佐证:9 月 17 日 NIST 旗下 CAISI 独立评估称 GLM-5.3 是「迄今网络能力最强的开放权重模型」。
- Anthropic 结论:GLM-5.3 松散的护栏显著提升了恶意攻击者的网络能力,但同类能力也能为防御者所用。
这标志着前沿网络攻防能力从单家模型扩散到开放权重模型,护栏差距成为新的行业焦点。
所属事件:Anthropic 报告:GLM-5.3 网络攻击能力逼近 Claude,护栏形同虚设(21 条相关)→
「模型」频道最新
- GPT-6.1 Sol 生成 3D 键盘装配动画,价格仅为 Sonnet 5.5 三十分之一 — BorisMPower · 2026-09-30
- Claude Sonnet 5.5 即将上线 LMArena,可直接实测 — arena · 2026-09-30
- ARC Prize 将评测 DeepSeek V4.1 Flash,前作曾得 ARC-AGI-2 61.4% — teortaxesTex · 2026-09-30
- gpt-6.1-sol 跑简单校验任务 35 分钟未停,用户担忧额度耗尽 — arthurcolle · 2026-09-30
- 曝 OpenAI 内部基准显示 GPT-6.1 Sol 大幅领先 Opus 5.5,Anthropic 难以追赶 — wilyi · 2026-09-30
- GPT-6.1 Sol 实测:105 个植入 bug 修 44 个,成本仅为上代 1/15 — PawelHuryn · 2026-09-30