Qwen 3.8 Flash-Next 发布:6B 稀疏 MoE 超越 Claude Opus

SimplyAnnisa · x · 2026-08-26

阿里发布 Qwen 3.8 Flash-Next,这是一个 6B 激活参数的稀疏 MoE 模型。该模型拥有 125B 总参数和 51B 额外 n-gram 嵌入,但在每个 token 处理时仅激活 6B 参数。

在 9 项对比基准中的 8 项,该模型击败了 Claude Opus 4.6 Max。具体成绩包括:

所属事件:阿里开源Qwen3.8-Flash-Next:125B稀疏MoE预览Qwen4架构(11 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →