Baseten 支持 GLM-5.3-Flash 进行 RL 与微调
baseten · x · 2026-08-26
Baseten 宣布在其 Loops 平台上支持对 GLM-5.3-Flash 模型进行强化学习(RL)或微调(SFT/OPD)。该模型因体积小于 Kimi K3、DSV4 Pro 和 GLM 5.2 而具备更低的推理成本,且针对长上下文推理效率进行了重新设计,非常适合作为进一步 RL 训练的基础模型。
「模型」频道最新
- 评 DeepSeek V4:实测强于榜单,缺原生视觉预训练 — teortaxesTex · 2026-08-26
- Qwen3.8-27B 在 AMD R9700 上实测 — samsja19 · 2026-08-26
- 网友晒图吐槽 Gemini 表现糟糕:Gemini you are fired — dh7net · 2026-08-26
- 用户发现特定提示词可触发 Opus 4.6 及 GPT Image 1.5 — koltregaskes · 2026-08-26
- Qwen3.8-Flash-Next 跻身 Code Arena 前八,WebDev 超强 — arena · 2026-08-26
- GLM-5.3-Flash 日处理 100T tokens,竟全靠国产芯片 — airesearch12 · 2026-08-26