Qwen 3.8 Flash-Next 发布:6B 激活参数击败 Claude Opus

kimmonismus · x · 2026-08-26

阿里通义千问团队发布 Qwen3.8-Flash-Next,这是一个极其稀疏的 MoE 模型。虽然总参数达 1250 亿(外加 510 亿 n-gram 嵌入),但每个 Token 仅激活 60 亿参数。在多项基准测试中,该模型表现优异:在 SWE-bench Pro (62.5)、SWE-bench 多语言、CoWorkBench 等 8 个可比指标上击败了 Claude Opus 4.6 Max。此外,模型支持原生 256K 上下文并可扩展至 1M,且在长上下文下推理速度有显著提升(预填快 7.6 倍,解码快 4.9 倍)。

所属事件:阿里发布Qwen3.8-Flash(Next):125B稀疏MoE预览Qwen4架构(8 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →