GLM-5.3-Flash 发布:320B 规模 MIT 开源,性能超上代
matei_zaharia · x · 2026-08-26
Zai 发布 GLM-5.3-Flash (Ox Alpha),这是一个 320B-A18B 模型,参数量仅为 GLM-5.2 的一半不到,但在所有基准测试中均超越了后者。该模型原生支持多模态,拥有 100 万 token 上下文窗口,并在发布时采用 MIT 开源许可。此外,模型完全在国产 AI 芯片上运行。Databricks 宣布将尽快为客户提供该模型支持。
所属事件:智谱开源GLM-5.3-Flash:320B MoE、百万上下文、成本仅前代十分之一(29 条相关)→
「模型」频道最新
- Qwen3.8-Flash-Next 发布 1-4bit GGUF 量化版 — MaziyarPanahi · 2026-08-27
- Claude 口头禅「这不是X而是Y」更可能来自后训练而非互联网数据 — burkov · 2026-08-27
- 307M 参数小模型 LateOn,在评测中击败 26 倍大的 Qwen — lateinteraction · 2026-08-27
- GLM-5.3-flash 效率拆解:十分之一成本胜前代,激活参数近乎减半 — baseten · 2026-08-27
- 跨模型 Token 比较无意义,推理时代指标更需细分 — adamdangelo · 2026-08-27
- Yutori 发布 n2 模型,低成本实现全桌面计算机控制 — DhruvBatra_ · 2026-08-27