GLM-5.3-Flash 发布:320B MoE 架构,MIT 开源

TheZachMueller · x · 2026-08-27

GLM-5.3-Flash 发布,前身为 Ox Alpha。该模型采用 320B-A18B 稀疏 MoE 架构,支持 100 万上下文与原生多模态,基于 MIT 协议开源。架构上融合了 Kimi Linear 混合注意力、DeepSeek 稀疏注意力与 mHC 残差路径,并在中国芯片上运行。

所属事件:智谱开源 GLM-5.3-Flash:320B MoE、1M 上下文、价格仅前代十分之一(33 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →