Fireworks 修复 GLM-5.3-Flash 过度思考问题后上线

智谱 GLM-5.3-Flash 模型在 Fireworks 平台上正式上线,但未能在 Day 0 发布。原因是 Fireworks AI 在部署时发现开源引擎在 AIME、GPQA 等重推理基准上存在过度思考行为,思考长度达到 Zai API 的两倍,虽然分数相同但 Token 消耗显著增加。团队随后修复了该效率问题,并将改进回馈给开源社区。

2026-08-30 ~ 2026-08-30 · 2 条相关