智谱开源 GLM-5.3-Flash:320B MoE 对标 Opus 4.8,价格仅 1/40
智谱于 08-26 正式发布并开源 GLM-5.3-Flash,即此前在 OpenRouter 上引发热议的神秘模型 Ox Alpha。该模型以远低于对标旗舰的价格提供了前沿性能,成为当日最受关注的模型发布事件。
已确认
- 架构:320B 总参数、18B 激活参数的 MoE,为 GLM-5 系列首款原生多模态模型,支持 100 万 token 上下文窗口;采用稀疏注意力与线性注意力混合机制,在保持精确长上下文能力的同时显著降低长上下文服务成本(@Zaiorg、@multimodalart)。
- 性能:Artificial Analysis Intelligence Index 得分 57,与 Claude Opus 4.8 持平并位于 Pareto 前沿;Code Bench 真实编码基准中在所有算力等级上显著超越 GLM-5.2,与 Opus 4.8 持平(@Zaiorg、@op7418)。
- 定价:标准 API 每百万 tokens 输入 0.15 美元、输出 0.50 美元、缓存输入 0.03 美元;@Hesamation 测算单任务约 0.045 美元,比 GLM-5.3 便宜 15 倍、比 Opus 4.8 便宜约 45 倍。
- 开源:以 MIT 协议开源;FP8 权重约占 328GB,目前部署于昇腾硬件,尚未使用 NVFP4(@zephyrz9)。
- 算力:@orange 转述官方称全球每日超 100T 的供应量全部由国产芯片支撑,端到端服务性能提升 3 倍。
- 生态:OpenRouter 等平台已接入;该模型此前已在 OpenRouter 消耗 23.2T tokens,并终结了 DeepSeek 的消耗霸榜纪录(@op7418);已获 vLLM 支持。
为什么重要
- 该模型以约 1/40 的价格达到与 Claude Opus 4.8 持平的智力指数,重塑性能价格比的 Pareto 前沿,对闭源旗舰 API 定价形成直接压力。
- MIT 协议开源 320B MoE 多模态模型,加上完全由国产芯片支撑的算力底座,被视为可能改变行业格局的信号。
- 架构层面以混合注意力降低长上下文服务成本,与同期 Qwen3.8-Flash-Next 等共同代表了高效推理模型的新一轮趋势。
2026-08-26 ~ 2026-08-26 · 23 条相关
- 第 1 集:隐身模型 Ox Alpha 引爆社区:指纹指向智谱 GLM-5.3(2026-08-21,58 条)
- 第 2 集:OpenRouter 神秘模型 Ox Alpha 被识别为 GLM(2026-08-21,3 条)
- 第 3 集:Cola 发布 Ox 模型 宣称 Terra 级能力 Flash 级速度(2026-08-21,2 条)
- 第 4 集:神秘模型 Ox Alpha 免费送出百万亿 token 引算力质疑(2026-08-21,2 条)
- 第 5 集:Ox-Alpha 模型实测不佳被指营销噱头(2026-08-22,3 条)
- 第 6 集:Ox Alpha 完整 DeepSWE 实测约 63%,此前 80% 系子集误报(2026-08-22,6 条)
- 第 7 集:取证揭秘:匿名模型 Ox Alpha 被多方证实为智谱 GLM(2026-08-22,31 条)
- 第 8 集:Ox Alpha 单次生成6.4万token构建3D场景(2026-08-22,2 条)
- 第 9 集:神秘模型 Ox Alpha 实测口碑两极分化(2026-08-22,6 条)
- 第 10 集:神秘模型 Ox Alpha 免费上线,真实身份成谜(2026-08-23,3 条)
- 第 11 集:匿名模型 Ox Alpha 登陆 OpenRouter 引发热议(2026-08-24,5 条)
- 第 12 集:爆料称Ox Alpha即GLM-5.3 Flash:320B参数价格打一折(2026-08-25,4 条)
- 第 13 集:神秘模型 Ox Alpha 证实为智谱 GLM,当晚开源权重(2026-08-25,15 条)
- 第 14 集:隐身模型 Ox Alpha 编码实测平平,修复率不及 Grok 4.6(2026-08-25,3 条)
- 第 15 集:神秘模型 Ox Alpha 六天狂耗 42T tokens 引猜测(2026-08-26,3 条)
- 第 16 集:智谱开源 GLM-5.3-Flash:320B MoE 对标 Opus 4.8,价格仅 1/40(2026-08-26,23 条)
一手来源
- 智谱开源 GLM-5.3-Flash:320B 参数性能对标 Opus,价格仅 1/40 — 智谱 ·
- GLM-5.3-Flash 编程性能追平 Claude Opus 4.8 — Zai_org ·
- Zai 发布 GLM-5.3-Flash 定价:输入 0.15 美元 — Zai_org ·
- 【源头】智谱开源 GLM-5.3-Flash:320B 参数性能对标 Opus,价格仅 1/40 — 智谱 · 2026-08-26
- 【源头】Zai 发布 GLM-5.3-Flash 定价:输入 0.15 美元 — Zai_org · 2026-08-26
- 【源头】GLM-5.3-Flash 编程性能追平 Claude Opus 4.8 — Zai_org · 2026-08-26
- 架构升级使 GLM-5.3-Flash 更智能更省算 — Zai_org · 2026-08-26
- Zai 推出 320B 参数 GLM-5.3-Flash 模型 — TheZachMueller · 2026-08-26
- 智谱发布 GLM-5.3-Flash:320B 参数 MIT 开源 — TheZachMueller · 2026-08-26
- 智谱疑似悄然发布 glm-5.3-flash 模型 — koltregaskes · 2026-08-26
- 智谱 GLM-5.3-Flash 发布:性能超 Opus 4.8,体积更小 — airesearch12 · 2026-08-26
- GLM-5.3-Flash 采用混合注意力降成本 — multimodalart · 2026-08-26
- GLM-5.3-Flash 采用稀疏+线性注意力混合架构 — multimodalart · 2026-08-26
- 智谱发布 GLM-5.3-Flash:前沿智能与极速成本 — dydynam · 2026-08-26
- 智谱发布GLM 5.3 Flash Vision:320B参数、价格仅Opus 4.8的1/40 — oran_ge · 2026-08-26
- GLM-5.3 Flash 曝光:320B 总参数 18B 激活,部署于昇腾 — zephyr_z9 · 2026-08-26
- 智谱GLM 5.3发布:国产芯片日供百T算力,成本降至前代1/10 — oran_ge · 2026-08-26
- 智谱 GLM-5.3-Flash 发布:基准测试数据出炉 — elemental-mind · 2026-08-26
- 智谱 GLM 5.3 Flash 发布:320B 参数,价格打一折 — oran_ge · 2026-08-26
- 智谱 GLM-5.3-Flash 发布:320B MoE 混合注意力与百万上下文 — TheZachMueller · 2026-08-26
- 智谱 GLM-5.3-Flash 开源:320B 参数 MIT 协议 — realsohamparekh · 2026-08-26
- GLM-5.3-Flash 获评 57 分,登顶 Pareto 前沿 — ollama · 2026-08-26
- GLM-5.3-Flash 性能持平 Opus 4.8 但便宜 45 倍 — Hesamation · 2026-08-26
- 智谱 GLM-5.3-Flash 公开:320B 参数 MIT 开源 — op7418 · 2026-08-26
- 智谱发布 GLM-5.3-Flash:混合稀疏注意力架构 — No_Afternoon_4260 · 2026-08-26
- Qwen 与 GLM 新模型实测赶超 Claude Opus — kimmonismus · 2026-08-26