智谱官方上线GLM-5.3-FlashX:最高200 tokens/s,API已开放

智谱 · wechat · 2026-09-18

智谱宣布正式推出GLM-5.3-FlashX,推理速度最高200 tokens/s,API已上线,模型Key为GLM-5.3-FlashX,企业和开发者可直接调用。

前作GLM-5.3-Flash曾以"OxAlpha"之名与全球开发者见面,调用量持续攀升。此次升级在10万张国产芯片提供的推理算力基础上,进一步加大Infra侧投入与推理优化。智谱称GLM-5.3-Flash长期保持同尺寸最强智能水平与高性价比,FlashX在此基础上形成智能、价格、速度的全面竞争力。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →