GLM-5.3发布:编码基准超Opus 4.8,Terminal Bench从4.6飙至28.3
ConfessionDiariesPH · reddit · 2026-08-14
GLM-5.3发布,在多个编码基准上超越Opus 4.8,与DeepSeek V4 Pro基本持平。最亮眼的是Terminal Bench 3.0从5.2的4.6跃升至5.3的28.3,这是长时程任务基准,大幅提升比常规谜题更有意义。值得注意的是,5.3与5.2是同一基础模型,全部提升来自后训练,没有新预训练。Fable 5和GPT-5.6 Sol仍领先,但差距已缩小。作者还提到5.3的工具调用更稳定,安全方面也有提升,能在旧开源软件中发现真实漏洞并走正规披露流程。
所属事件:智谱发布GLM 5.3,编码与网络安全能力跃升(32 条相关)→
「模型」频道最新
- Qwen3.8-Max登陆Nebius Token Factory,Day 0开放权重 — Arindam_1729 · 2026-08-14
- Qwen 3.8-Max 登陆 Modal:2.4T 参数、1M 上下文,配备 DFlash 投机解码 — AAAzzam · 2026-08-14
- GLM-5.3 发布:743B 基座后训练,编码与网络安全能力跃升 — sudoraohacker · 2026-08-14
- Qwen3.8 27B 对比 Qwen3.6 27B 与 Gemma 4 31B:24GB 显卡本地运行 — MaySaki2 · 2026-08-14
- Qwen3.8-27B开源,SGLang Day-0支持,RTX 5090上206 tok/s — ying11231 · 2026-08-14
- Qwen3.8-Max登陆DigitalOcean Serverless,支持1M上下文 — Alibaba_Qwen · 2026-08-14