GLM-5.3-Flash 采用混合注意力降成本

multimodalart · x · 2026-08-26

GLM-5.3-Flash 发布,基于新的基础模型重新设计了架构和训练配方。该模型采用了稀疏注意力与线性注意力的混合机制,在保持精确长上下文能力的同时,显著降低了长上下文服务的成本。

所属事件:智谱发布 GLM-5.3-Flash:320B MoE 架构支持百万上下文(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →