智谱开源 GLM-5.3-Flash:320B MoE 多模态前沿模型
智谱于 8 月 26 日正式发布并开源 GLM-5.3-Flash(代号 Ox Alpha),这是 GLM-5 系列首个原生多模态模型,也是 glm5next 架构的首个开源权重版本。模型以 MIT 协议在 Hugging Face 上发布,主打“前沿智能 + Flash 极速成本”,官方宣称价格仅为 GLM-5.2 的十分之一。
已确认
- 架构与规模:320B 总参数、18B 激活参数的稀疏 MoE 架构,融合 Kimi Linear 混合注意力与 DeepSeek 相关技术(稀疏注意力 + 线性注意力),原生多模态,支持 100 万 token 上下文窗口,已获 vLLM 支持
- 定价:官方标准 API 定价为每 100 万 tokens 输入 $0.15、输出 $0.50、缓存输入 $0.03
- 性能表现:官方称在 Code Bench 真实编码基准中所有算力等级均显著超越 GLM-5.2,与 Claude Opus 4.8 持平;Artificial Analysis 智力指数得分 57,仅比完整版 GLM-5.3 低 3 分,与 GLM-5.3 一起位于 Pareto 前沿
- 硬件部署:据 @zephyrz9 与 @orange 转述,模型 FP8 权重约 328GB,部署在昇腾等国产芯片上,官方称每日超 100T 算力供应全部由国产芯片支撑
尚未确认
- 具体基准数据的第三方复现结果尚待更多独立评测;官方宣称的性能对比(如追平 Opus 4.8)目前主要来自官方博客与 Artificial Analysis 初步评测
为什么重要
- 参数量不到 GLM-5.2 的一半却在各基准全面超越,配合极低定价,被 @bindureddy 等认为有潜力成为使用最广泛的开源模型;@Hesamation 测算其单任务成本约 $0.045,比 GLM-5.3 便宜 15 倍、比 Opus 4.8 便宜约 45 倍
- 全部推理算力由国产芯片支撑,若属实对行业供给格局有重要影响,也是开源社区少见的“性能-成本”双优选择
2026-08-25 ~ 2026-08-27 · 38 条相关
一手来源
- Zai 在 Hugging Face 发布 GLM-5.3-Flash 模型 — zai-org ·
- Zai 发布 GLM-5.3-Flash 定价:输入 0.15 美元 — Zai_org ·
- GLM-5.3-Flash 编程性能追平 Claude Opus 4.8 — Zai_org ·
- 【源头】Zai 在 Hugging Face 发布 GLM-5.3-Flash 模型 — zai-org · 2026-08-25
- 智谱开源 GLM-5.3-Flash:320B 参数性能对标 Opus,价格仅 1/40 — 智谱 · 2026-08-26
- 【源头】Zai 发布 GLM-5.3-Flash 定价:输入 0.15 美元 — Zai_org · 2026-08-26
- 【源头】GLM-5.3-Flash 编程性能追平 Claude Opus 4.8 — Zai_org · 2026-08-26
- 架构升级使 GLM-5.3-Flash 更智能更省算 — Zai_org · 2026-08-26
- Zai 推出 320B 参数 GLM-5.3-Flash 模型 — TheZachMueller · 2026-08-26
- 智谱发布 GLM-5.3-Flash:320B 参数 MIT 开源 — TheZachMueller · 2026-08-26
- 智谱疑似悄然发布 glm-5.3-flash 模型 — koltregaskes · 2026-08-26
- 智谱 GLM-5.3-Flash 模型发布于 Hugging Face — coder543 · 2026-08-26
- 智谱 GLM-5.3-Flash 发布:性能超 Opus 4.8,体积更小 — airesearch12 · 2026-08-26
- GLM-5.3-Flash 采用混合注意力降成本 — multimodalart · 2026-08-26
- GLM-5.3-Flash 采用稀疏+线性注意力混合架构 — multimodalart · 2026-08-26
- 智谱发布 GLM-5.3-Flash:前沿智能与极速成本 — dydynam · 2026-08-26
- 智谱发布GLM 5.3 Flash Vision:320B参数、价格仅Opus 4.8的1/40 — oran_ge · 2026-08-26
- GLM-5.3 Flash 曝光:320B 总参数 18B 激活,部署于昇腾 — zephyr_z9 · 2026-08-26
- 智谱GLM 5.3发布:国产芯片日供百T算力,成本降至前代1/10 — oran_ge · 2026-08-26
- 智谱 GLM-5.3-Flash 发布:基准测试数据出炉 — elemental-mind · 2026-08-26
- 智谱 GLM 5.3 Flash 发布:320B 参数,价格打一折 — oran_ge · 2026-08-26
- 智谱 GLM-5.3-Flash 发布:320B MoE 混合注意力与百万上下文 — TheZachMueller · 2026-08-26
- 智谱 GLM-5.3-Flash 开源:320B 参数 MIT 协议 — realsohamparekh · 2026-08-26
- GLM-5.3-Flash 获评 57 分,登顶 Pareto 前沿 — ollama · 2026-08-26
- GLM-5.3-Flash 性能持平 Opus 4.8 但便宜 45 倍 — Hesamation · 2026-08-26
- 智谱 GLM-5.3-Flash 公开:320B 参数 MIT 开源 — op7418 · 2026-08-26
- 智谱发布 GLM-5.3-Flash:混合稀疏注意力架构 — No_Afternoon_4260 · 2026-08-26
- Qwen 与 GLM 新模型实测赶超 Claude Opus — kimmonismus · 2026-08-26
- GLM-5.3-Flash 发布:320B 规模 MIT 开源,性能超上代 — matei_zaharia · 2026-08-26
- 智谱发布 GLM-5.3-Flash:低成本前沿模型 — 1littlecoder · 2026-08-27
- 智谱开源 GLM-5.3 Flash:320B 参数登顶全球榜单 — 量子位 · 2026-08-27
- GLM-5.3-Flash 发布:320B MoE 架构,MIT 开源 — TheZachMueller · 2026-08-27
- 智谱 GLM-5.3-Flash 定价曝光:输入 0.15 美元 — bindureddy · 2026-08-27
- 智谱GLM-5.3-Flash发布:MIT开源,百万上下文 — ramagetime · 2026-08-27
- GLM-5.3-Flash 评测:成本仅大模型 10%,登顶性价比 frontier — ArtificialAnlys · 2026-08-27
- GLM-5.3-Flash 发布:320B 总参数,成本效率居 Pareto 前沿 — ArtificialAnlys · 2026-08-27
- GLM-5.3-Flash 正式发布:原生多模态,1M 上下文,成本仅前代 1/10 — ying11231 · 2026-08-27
- 更正:GLM-5.3-Flash 上下文窗口为 100 万 — ArtificialAnlys · 2026-08-27
- GLM-5.3-Flash 发布:百万上下文,评测分大涨 — qinzytech · 2026-08-27
- GLM-5.3-Flash 上线:百万上下文仅 0.15 美元 — gharik · 2026-08-27
另有 1 条近重复转述:wandb