GLM-5.3-Flash 采用稀疏+线性注意力混合架构

multimodalart · x · 2026-08-26

除了 Qwen3.8-Flash-Next 外,新发布的 GLM-5.3-Flash 基于重新设计的基础模型和训练配方。其采用稀疏与线性注意力混合架构,在保持精确长上下文能力的同时,大幅降低了长上下文服务的成本。

所属事件:智谱发布 GLM-5.3-Flash:320B MoE 架构支持百万上下文(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →