智谱 GLM-5.3 突破源于后训练而非基座
teortaxesTex · x · 2026-08-19
技术分析显示,GLM-5.3 复用了 GLM-5.2 的 743B MoE 基座,其性能提升主要归功于后训练栈(SFT → SAO → OPD → 大规模可执行沙箱训练)。这表明更好的 RL 基础设施、训练环境和蒸馏技术能大幅挖掘现有基座的潜力。
「研究」频道最新
- 北大 Kling 团队推 RefCaptioner,解决视频理解幻觉难题 — jiqizhixin · 2026-08-19
- 「Scaling laws 非自然定律」:更好数据与架构仍能掰弯曲线 — bookwormengr · 2026-08-19
- PixRestore:像素空间扩散模型实现统一图像复原 — Lingchen Sun · 2026-08-19
- 跨模型记忆复用新法:只需适配目标端读取器 — OLAResearchX · 2026-08-19
- DeepSeek 助力工业赛道冠军,探索推荐系统 Scaling Law — jiqizhixin · 2026-08-19
- Agent 发展趋势:自动集成代码扩展 — _philschmid · 2026-08-19