GLM-5.3安全评测:75% CVE复现率超GPT-5.6,成本低40%
joshua_saxe · x · 2026-08-15
第三方安全评测机构提前获得GLM-5.3,评估其网络攻击能力。结果显示:在pass@3下,GLM-5.3能复现基准测试中75%的CVE漏洞,比GPT-5.6-Terra高7个百分点,且运行成本低40%。在pass@1下,平均能发现60.4%的CVE,是开源模型中的最高分。同时,其误报率低于DeepSeek v4等模型,输出更可靠。评测者认为GLM-5.3是开源模型中最强、最一致的网络任务模型。
所属事件:智谱发布GLM 5.3,编码与网络安全能力大幅提升(35 条相关)→
「模型」频道最新
- 首个医疗三元模型Pestle 27B发布,Apache 2.0开源 — Individual-Dot5488 · 2026-08-15
- 前沿模型全面降价,开源闭源齐降,智能体成本更优 — markjeffrey · 2026-08-15
- RedNote AI实验室新RL方法TEMPO:16B模型ARC-AGI 3得分超30% — GregKamradt · 2026-08-15
- Orion-16B突破100B训练token,采用去中心化算力 — const_reborn · 2026-08-15
- AI模型评测:基线被碾压,最佳模型接近完成课程 — const_reborn · 2026-08-15
- Qwen3.8获LightSeek Day-0支持,推理性能提升30%+ — Alibaba_Qwen · 2026-08-15