智谱上线 GLM-5.3-FlashX,速度最高 200 tokens/s

智谱发布 GLM-5.3-Flash 的提速版本 GLM-5.3-FlashX,模型代码为 glm-5.3-flashx,现已面向所有 API 用户开放。新模型最高速度可达 200 tokens/s,定价为 GLM-5.3-Flash 的 2.5 倍,为对延迟敏感的应用提供更快选择。

2026-09-22 ~ 2026-09-23 · 2 条相关