Fireworks 修复 GLM-5.3-Flash 过度思考问题后上线
智谱 GLM-5.3-Flash 模型在 Fireworks 平台上正式上线,但未能在 Day 0 发布。原因是 Fireworks AI 在部署时发现开源引擎在 AIME、GPQA 等重推理基准上存在过度思考行为,思考长度达到 Zai API 的两倍,虽然分数相同但 Token 消耗显著增加。团队随后修复了该效率问题,并将改进回馈给开源社区。
2026-08-30 ~ 2026-08-30 · 2 条相关
- 智谱GLM-5.3-Flash登陆Fireworks,为修复过思考延迟推迟两天 — lqiao · 2026-08-30
- Fireworks 发现推理低效,延后 GLM-5.3 上线 — AccBalanced · 2026-08-30