阿里开源Qwen3.8-Flash-Next:6B激活参数的超稀疏MoE预览Qwen4架构

8月26日,阿里通义千问团队在Hugging Face与ModelScope发布并开源多模态MoE模型Qwen3.8-Flash-Next,定位为Qwen4架构的早期预览,并同步发布技术报告与详细性能评测。模型主参数125B、外加约51B N-gram嵌入参数,每token仅激活6B参数,官方与媒体称训练成本降至前代约1/9;vLLM、SGLang与NVIDIA NeMo均已实现Day-0支持。社区转述其基准表现以约一半参数量击败DeepSeek V4 Flash并超越Claude Opus 4.6,编码榜单上拿下ClawEval与多语言SWE-Bench第一,是当日最受关注的开源模型事件,8月27日起量子位、智东西等媒体跟进报道进一步扩散。

已确认

尚未确认

为什么重要

2026-08-26 ~ 2026-08-28 · 25 条相关

事件全程(共 6 集)→

一手来源

另有 2 条近重复转述:SimplyAnnisa · bindureddy