阿里开源 Qwen3.8-Flash:125B MoE 成本降九成
阿里发布并开源 Qwen3.8-Flash 模型,采用新一代 MoE 架构,总参数 125B 但每个 Token 仅激活约 6B,训练成本较此前大幅下降约九成。该模型原生支持 262k 上下文并可扩展至 1M token,消费级 4090 显卡也能运行。官方与第三方评测称其在编程、办公等核心任务上超越 Claude Opus 4.6,Two Minute Papers 等媒体称其性能可匹敌大厂数十亿美元级模型且完全免费。
2026-08-28 ~ 2026-08-28 · 3 条相关
- 第 1 集:阿里官宣 Qwen3.8-Flash-Next 开源,预览 Qwen4 架构(2026-08-25,13 条)
- 第 2 集:阿里开源Qwen3.8-Flash-Next:Qwen4架构预览,6B激活参数引热议(2026-08-26,26 条)
- 第 3 集:Qwen3.8-Flash 开放本地运行,SWE-bench Pro 跑分超 Opus(2026-08-26,5 条)
- 第 4 集:Qwen3.8-Flash-Next FP8 量化模型在 Hugging Face 发布(2026-08-27,2 条)
- 第 5 集:Qwen 3.8-Next 发布,技术报告详解架构与预训练(2026-08-27,2 条)
- 第 6 集:阿里开源 Qwen3.8-Flash:125B MoE 成本降九成(2026-08-28,3 条)
- Qwen3.8-Flash-Next 发布:媲美大厂模型的免费 AI — Two Minute Papers · 2026-08-28
- Qwen3.8-Flash 开源:卷死 DeepSeek,4090 跑 1M 上下文 — 量子位 · 2026-08-28
- 阿里 Qwen3.8-Flash:125B 参数仅激活 6B,成本降九成 — 大模型之路 · 2026-08-28