GLM-5.3 攻防能力逼近 Claude,20 美元找出 Chrome 漏洞
DeepLearningAI · x · 2026-10-04
Andrew Ng 在本周 The Batch 信中分析 Anthropic 对开源权重模型 GLM-5.3 网络安全能力的评估:在 ExploitBench 漏洞利用任务子集上,GLM-5.3 在相近 token 花费下成功 12%,仅略低于 Claude Mythos 的 14%(不过 GLM 官方在完整基准上的数字是 54.4% vs 78.0%,差距更大)。
关键点:
- 成本暴跌:Anthropic 发现花 20.40 美元的 GLM-5.3-Flash token 就足以找到 Google Chrome 一个近期披露的漏洞;且护栏被削弱的开源模型更容易获取,攻防效果更强。
- 防御方受益:买不到闭源旗舰模型的防御者也能用高能力开源模型来做防御。
- Ng 的判断:与其恐惧能力落入坏人之手,不如把这当作工程问题——防御方掌握长期优势,应加速加固防御。
所属事件:开源GLM-5.3漏洞利用能力逼近Claude(2 条相关)→
「模型」频道最新
- Claude Max 20 两天烧光额度,重度用户求助续命方案 — Khaigan · 2026-10-04
- 用户反映 OpenAI Deep Research 连续多天返回零引用 — JeremyNguyenPhD · 2026-10-04
- OpenRouter 发布模型路由基准:7 款路由器在 6 项测试中横向对比 — AccBalanced · 2026-10-04
- 网友质疑 Anthropic 花 2200 GPU 小时给 GLM 去审查:91 天 4400 美元不合理 — npinto · 2026-10-04
- 大量中国用户借 T3 Code 绕过封禁访问 Claude 模型 — ns123abc · 2026-10-04
- Reddit 用户盛赞 OpenAI 免费 dots:Debian 盒子跑 GPT-6 体验惊艳 — amxv_999 · 2026-10-04