智谱上线 GLM-5.3-FlashX,速度最高 200 tokens/s
智谱发布 GLM-5.3-Flash 的提速版本 GLM-5.3-FlashX,模型代码为 glm-5.3-flashx,现已面向所有 API 用户开放。新模型最高速度可达 200 tokens/s,定价为 GLM-5.3-Flash 的 2.5 倍,为对延迟敏感的应用提供更快选择。
2026-09-22 ~ 2026-09-23 · 2 条相关
- 智谱上线极速版 GLM-5.3-FlashX:最高 200 tokens/s — Zai_org · 2026-09-22
- 智谱上线 GLM-5.3-FlashX:最高 200 tokens/s,定价 2.5 倍 — pcuenq · 2026-09-23