Qwen 3.8 Flash-Next 发布:6B 激活参数击败 Claude Opus
kimmonismus · x · 2026-08-26
阿里通义千问团队发布 Qwen3.8-Flash-Next,这是一个极其稀疏的 MoE 模型。虽然总参数达 1250 亿(外加 510 亿 n-gram 嵌入),但每个 Token 仅激活 60 亿参数。在多项基准测试中,该模型表现优异:在 SWE-bench Pro (62.5)、SWE-bench 多语言、CoWorkBench 等 8 个可比指标上击败了 Claude Opus 4.6 Max。此外,模型支持原生 256K 上下文并可扩展至 1M,且在长上下文下推理速度有显著提升(预填快 7.6 倍,解码快 4.9 倍)。
所属事件:阿里发布Qwen3.8-Flash(Next):125B稀疏MoE预览Qwen4架构(8 条相关)→
「模型」频道最新
- 爆料称 opencode 新模型实为“削弱版多模态 GLM-5.3” — PawelHuryn · 2026-08-26
- 某模型在 Hugging Face 上发布 40 分钟即成历史最快趋势 — MaziyarPanahi · 2026-08-26
- Qwen 3.8 Flash 实测:SWE-bench Pro 跑分超 Opus — Hesamation · 2026-08-26
- Qwen3.8-Flash-Next 发布:新架构极致降本 — tosh · 2026-08-26
- 实测 Qwen3.8-27b 本地生成 Minecraft 克隆版 — liright · 2026-08-26
- 实测:ChatGPT 5.6 Sol 选车逻辑与路况检索翻车三例 — kaljakin · 2026-08-26