Qwen 3.8 Flash-Next 发布:6B 稀疏 MoE 超越 Claude Opus
SimplyAnnisa · x · 2026-08-26
阿里发布 Qwen 3.8 Flash-Next,这是一个 6B 激活参数的稀疏 MoE 模型。该模型拥有 125B 总参数和 51B 额外 n-gram 嵌入,但在每个 token 处理时仅激活 6B 参数。
在 9 项对比基准中的 8 项,该模型击败了 Claude Opus 4.6 Max。具体成绩包括:
- SWE-bench Pro: 62.5
- SWE-bench Multilingual: 81.0
- CoworkBench: 73.9
- JobBench: 55.7
- Toolathlon: 73.5
- IFBench: 81.3
所属事件:阿里开源Qwen3.8-Flash-Next:125B稀疏MoE预览Qwen4架构(11 条相关)→
「模型」频道最新
- GLM-5.3-Flash 采用稀疏+线性注意力混合架构 — multimodalart · 2026-08-26
- GLM-5.3-Flash 采用混合注意力降成本 — multimodalart · 2026-08-26
- 智谱 GLM-5.3-Flash 发布:性能超 Opus 4.8,体积更小 — airesearch12 · 2026-08-26
- 智谱疑似悄然发布 glm-5.3-flash 模型 — koltregaskes · 2026-08-26
- mLateOn 表现惊艳,实测击败大型 Qwen 模型 — antoine_chaffin · 2026-08-26
- Zai 推出 320B 参数 GLM-5.3-Flash 模型 — TheZachMueller · 2026-08-26