阿里 Qwen3.8-Flash:125B 参数仅激活 6B,成本降九成

大模型之路 · wechat · 2026-08-28

阿里开源 Qwen3.8-Flash,采用新一代 MoE 架构,总参数 125B 但每次仅激活 6B。该模型在编程、办公等核心任务上超越 Claude Opus 4.6,训练成本较上一代降低近 90%,推理输入价格为 0.16 美元/百万 Token。

核心特性

行业影响

标志着大模型竞争从“堆参数”转向“拼效率”。旗舰级能力首次有望通过消费级硬件本地部署,极大降低了小团队使用顶级模型的门槛。

所属事件:阿里开源 Qwen3.8-Flash:125B MoE 成本降九成(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →