智谱 GLM-5.3 突破源于后训练而非基座

teortaxesTex · x · 2026-08-19

技术分析显示,GLM-5.3 复用了 GLM-5.2 的 743B MoE 基座,其性能提升主要归功于后训练栈(SFT → SAO → OPD → 大规模可执行沙箱训练)。这表明更好的 RL 基础设施、训练环境和蒸馏技术能大幅挖掘现有基座的潜力。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →