Baseten 支持 GLM-5.3-Flash 进行 RL 与微调

baseten · x · 2026-08-26

Baseten 宣布在其 Loops 平台上支持对 GLM-5.3-Flash 模型进行强化学习(RL)或微调(SFT/OPD)。该模型因体积小于 Kimi K3、DSV4 Pro 和 GLM 5.2 而具备更低的推理成本,且针对长上下文推理效率进行了重新设计,非常适合作为进一步 RL 训练的基础模型。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →