智谱官方上线GLM-5.3-FlashX:最高200 tokens/s,API已开放
智谱 · wechat · 2026-09-18
智谱宣布正式推出GLM-5.3-FlashX,推理速度最高200 tokens/s,API已上线,模型Key为GLM-5.3-FlashX,企业和开发者可直接调用。
前作GLM-5.3-Flash曾以"OxAlpha"之名与全球开发者见面,调用量持续攀升。此次升级在10万张国产芯片提供的推理算力基础上,进一步加大Infra侧投入与推理优化。智谱称GLM-5.3-Flash长期保持同尺寸最强智能水平与高性价比,FlashX在此基础上形成智能、价格、速度的全面竞争力。
「模型」频道最新
- Kimi Agent Swarm 云端实测:16 小时长任务自主纠错并完成训练 — solyarisoftware · 2026-09-18
- Domingos:智能的反面是蛮力,Astra 与 Mythos 极其愚蠢 — pmddomingos · 2026-09-18
- Xeophon:知识类评测已死,编程基准也在走向消亡 — xeophon · 2026-09-18
- 谷歌发布 Gemini 3.8 Live 与扩展思考版,用户实测称体验出色 — Arindam_1729 · 2026-09-18
- 腾讯 WeVisDoc 与 Jina OCR 同日上线,4B 版夺 OCR 榜首 — NielsRogge · 2026-09-18
- WeVisDoc 与 jina-ocr-v1 同日上线,4B 版 OmniDocBench 得 95.38 — NielsRogge · 2026-09-18