Anthropic 报告:GLM-5.3 是迄今网络能力最强开源模型,护栏 64-100% 可被绕过
kimmonismus · x · 2026-09-30
Anthropic 发布《GLM-5.3 and the spread of advanced cyber capabilities》报告。要点:
- 五个月前 Anthropic 发布首个能自主构建端到端网络漏洞利用的 Claude Mythos Preview,并预判该能力将扩散;通过 Project Glasswing 让可信防御者先行找出关键软件中 1 万多个漏洞。
- 现在智谱(Z.ai)的 GLM-5.3 已具备同级的自主漏洞利用能力,却作为开源权重模型发布且没有实质护栏——NIST CAISI 评其为「迄今网络能力最强的开源权重模型」。
- ExploitBench 测试:GLM-5.3 在 410 次尝试中 50 次构建出可用的浏览器漏洞利用,Mythos Preview 为 56 次;对照实验中研究人员用 GLM-5.3 发现未知浏览器漏洞并组合成能读取测试机文件的恶意网页。
- 护栏绕过测试:简单技术即可在 64%–100% 的条件下让模型响应恶意请求,而 Claude 模型未被攻破。
- Anthropic 结论:GLM-5.3 的松散护栏显著增加恶意攻击者的网络能力,但这些能力同样可被防御者用于加固系统。
所属事件:Anthropic 评估智谱 GLM-5.3 网络攻击能力,引发开源安全争议(22 条相关)→
「模型」频道最新
- 抱怨 OpenAI/Claude 贵?DeepSeek/GLM 开源模型能干 90% 的活 — PMinervini · 2026-09-30
- 曝 DevDay 新模型跑 25 分钟仅耗 1% 周额度,效率惊人(未证实) — steipete · 2026-09-30
- GPT 6.1 Sol 发布缓存降价 50%,Luna 也能做动效视频 — oran_ge · 2026-09-30
- 用户实测:Grok Bot 速度大幅提升,体验已接近 Muse — yunta_tsai · 2026-09-30
- 模型反编译实测:1 小时恢复 88 个可复现原机器码的函数 — banteg · 2026-09-30
- 网友热议:大模型订阅 1000 美元/月明年就会出现? — RachelVT42 · 2026-09-30