GLM-5.3 后训练效果惊人:同款700B底座已达GPT-5.6档
haider1 · x · 2026-08-30
用户实测发现,智谱 GLM-5.3 沿用与 5.2 相同的 700B 底座,但仅靠后训练就已在 Terminal-Bench 4.0 上逼近 GPT-5.6 Sol / Fable 5 的水平。更夸张的是 5.3 Flash:总参数 320B、激活仅 18B,开源权重且自托管成本大幅降低,实用性突出。原帖背景是新发布的 Terminal-Bench 4.0——评测迭代速度已快赶上模型开发本身。
「模型」频道最新
- GLM-5.3-Flash 登顶 Agent Arena 榜单第四 — AccBalanced · 2026-09-01
- 智谱 GLM-5.3 Flash 推出 INT4 与 MXFP4 版本 — HaihaoShen · 2026-09-01
- 南贝格 4.2 3B 模型发布 DSpark 权重 — teortaxesTex · 2026-09-01
- Qwen 2.5 72B 本地实测:长上下文吞吐跌一半 — julianharris · 2026-09-01
- DeepSeek 等模型 SWE-bench 得分辟谣:未达 80% — teortaxesTex · 2026-09-01
- Celeris-1 Magnus 登场:称霸 τ³-bench 的 Agent 专用模型 — timshi_ai · 2026-09-01