GLM-5.3发布:编码基准超Opus 4.8,Terminal Bench从4.6飙至28.3

ConfessionDiariesPH · reddit · 2026-08-14

GLM-5.3发布,在多个编码基准上超越Opus 4.8,与DeepSeek V4 Pro基本持平。最亮眼的是Terminal Bench 3.0从5.2的4.6跃升至5.3的28.3,这是长时程任务基准,大幅提升比常规谜题更有意义。值得注意的是,5.3与5.2是同一基础模型,全部提升来自后训练,没有新预训练。Fable 5和GPT-5.6 Sol仍领先,但差距已缩小。作者还提到5.3的工具调用更稳定,安全方面也有提升,能在旧开源软件中发现真实漏洞并走正规披露流程。

所属事件:智谱发布GLM 5.3,编码与网络安全能力跃升(32 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →