Anthropic 实测:开源的 GLM-5.3 写攻击程序能力直逼闭源 Mythos
lxfater · x · 2026-09-30
Anthropic 公布对智谱 GLM-5.3 的安全评测,结论是该开放权重模型的网络攻击能力已接近其内部高危模型 Mythos Preview。
- 写攻击程序:同一套 Chrome V8 已知漏洞题各跑 410 次,GLM-5.3 成功写出可用攻击程序 50 次,Mythos 56 次,而后者是关护栏跑的纯能力对比;Mythos 因此未对外开放,GLM-5.3 却人人可下载。
- 拒答很脆:官方版本直接要求攻击关键系统会拒,但谎称「攻防演练」时 64% 照做;在其思维链中预置决定可升至 92%;Anthropic 首次通过改权重移除拒答(花费约 4400 美元算力)后 100% 照做。发布几天后网上已流出去拒答版。
- 实战挖洞:研究员用约一天低干预运行,在某主流浏览器 JS 引擎挖出多个未知漏洞并串成恶意网页,可读取电脑任意文件(演示偷走 SSH 私钥),漏洞已通报厂商。
- 低成本攻击链:把一个新公开 Chrome 漏洞细节喂给小号 GLM-5.3-Flash,模型跑 8 小时自行串成攻击链,人只花 20 分钟,API 成本约 20.40 美元。
核心担忧:同级别模型要么带护栏要么只给审核过的防守方,而 GLM-5.3 开放权重且官方版本几乎不拒找漏洞类请求。
所属事件:Anthropic 评估 GLM-5.3 网络攻击力逼近 Claude,引开源安全之争(27 条相关)→
「模型」频道最新
- 曝 DeepSeek 开源高性能内核或为新模型铺路,传有单卡小模型 — teortaxesTex · 2026-09-30
- 用户爆料:OpenAI 连接 Gmail 后会自行翻查邮件且断开后仍留存 — alexcovo_eth · 2026-09-30
- DeepSeek 上线用户反馈渠道:下载 harness 开关即可帮助改进模型 — teortaxesTex · 2026-09-30
- Ollama 支持本地运行 Jev 风格决策模型,Nimble 单次决策仅 91ms — mchiang0610 · 2026-09-30
- 预训练算力超 1e22 FLOPs 后可直接砍掉视觉编码器 — heghbalz · 2026-09-30
- 6 个 LLM PK 97 格标注数据:漏提取的锅在 ASR 不在模型 — Sufficient_Flower860 · 2026-09-30