GLM-5.3-Flash 发布:320B MoE 架构,MIT 开源
TheZachMueller · x · 2026-08-27
GLM-5.3-Flash 发布,前身为 Ox Alpha。该模型采用 320B-A18B 稀疏 MoE 架构,支持 100 万上下文与原生多模态,基于 MIT 协议开源。架构上融合了 Kimi Linear 混合注意力、DeepSeek 稀疏注意力与 mHC 残差路径,并在中国芯片上运行。
所属事件:智谱开源 GLM-5.3-Flash:320B MoE、1M 上下文、价格仅前代十分之一(33 条相关)→
「模型」频道最新
- Gemini 3.5 Transcribe 上线,Enterprise Agent Platform 公测 — Saboo_Shubham_ · 2026-08-27
- Qwen3.8 27B 量化评测:4-bit 表现稳健,1-bit 崩溃 — pmigdal · 2026-08-27
- GLM-5.3-Flash 评测:成本仅大模型 10%,登顶性价比 frontier — ArtificialAnlys · 2026-08-27
- Google 公布 Gemini 3.7 Flash 定价详情 — OfficialLoganK · 2026-08-27
- Unsloth 推出 GLM-5.3-Flash GGUF 量化版 — unsloth · 2026-08-27
- N-Gram 表格技术能否改变本地大模型格局? — AcreMakeover · 2026-08-27