GLM-5.3 Flash 上线多家托管,开发者称媲美 Opus 4.8
Baseten 宣布其在 Artificial Analysis、OpenRouter 和 Hugging Face 上为 GLM-5.3-Flash 提供最快推理服务,速度超过 122 TPS。同时该模型的高推理(High reasoning)档已可在 Hugging Face 上直接试用,开发者 NielsRogge 正基于 Baseten 部署,并称其表现可媲美 Claude Opus 4.8。
2026-08-28 ~ 2026-08-28 · 3 条相关
- 第 1 集:智谱开源 GLM-5.3-Flash:320B MoE 多模态、成本降九成(2026-08-25,48 条)
- 第 2 集:GLM-5.3 Flash 实测刷屏:一线性能、美分级成本(2026-08-27,7 条)
- 第 3 集:GLM-5.3-Flash 评测:开源第三,成本仅为 Qwen 一半(2026-08-27,2 条)
- 第 4 集:GLM 5.3 Flash 限时 90% 折扣,输出价低至 0.04 美元(2026-08-27,2 条)
- 第 5 集:GLM-5.3 Flash 实测:修复力强且价格远低于竞品(2026-08-27,4 条)
- 第 6 集:智谱发布 GLM 5.3 Flash:性价比与跑分双双亮眼(2026-08-28,2 条)
- 第 7 集:GLM-5.3 Flash 上线多家托管,开发者称媲美 Opus 4.8(2026-08-28,3 条)
- Baseten 宣称 GLM-5.3-Flash 推理速度达 122+ TPS — baseten · 2026-08-28
- GLM-5.3-Flash 实测 270 tok/s:质量比 5.2 高 10%,成本仅十分之一 — Yuchenj_UW · 2026-08-28
- GLM-5.3 Flash 高推理档上线多家托管,开发者称可媲美 Opus 4.8 — _akhaliq · 2026-08-28