GLM-5.3 上线:同底座纯靠后训练,Terminal Bench 4.6 飙至 28.3
burny_tech · x · 2026-09-08
智谱宣布 GLM-5.3 API 正式上线,主打编码、防御性网络安全和长时程 Agent 任务,定价与 GLM-5.2 相同。研究者 QGallouedec 转发并指出关键信息:GLM-5.3 与 GLM-5.2 使用同一底座模型,预训练完全没变,仅靠后训练(RL)就让 Terminal Bench 3.0 成绩从 4.6 提升到 28.3,并登上 CyberGym 榜首,超过所有闭源前沿模型。这条信息被视为「前沿是 RL」的有力例证。
「模型」频道最新
- 某模型科学知识测试成绩回落,作者称结果尚可接受 — felpix_ · 2026-09-08
- VLM 网关实测:原生视频推理优于抽帧,但多数服务商暂不支持 — spillai · 2026-09-08
- Tibo 再度统一重置周期,用户推演「突袭重置」博弈与 token 省法 — tinyfool · 2026-09-08
- 高 AI 使用度经济学家群体:GPT 5.6 到 6 几乎无人察觉升级 — aniketapanjwani · 2026-09-08
- 数学家实测 Astra:60 小时攻克两个未发表定理,3 挑战耗 2 万美元 — basedjensen · 2026-09-08
- Reddit 用户开源 Claude.md 补丁,一键修复 Opus 文风劣化 — myriable · 2026-09-08