Qwen3.8-Flash-Next 发布:125B 总参数的多模态 MoE 架构预览
Simon Willison · rss · 2026-08-27
Qwen 发布了新的开源权重模型 Qwen3.8-Flash-Next。这是一个多模态 MoE 模型,作为 Qwen4 架构的早期预览。模型总参数量为 125B,但激活参数仅为 6B,旨在获得显著的性能提升。作者在 DGX Spark 上使用 Unsloth 量化版本进行了测试,尝试了 UD-IQ1S 和 UD-Q2KXL 两种量化规格,并展示了生成的图像效果。
「模型」频道最新
- 回顾 Nous 首个模型:基于 18 万条 GPT-4 数据的微调版 — Teknium · 2026-08-27
- Qwen3.8 剪枝实验:256 专家为平衡点,Q4 优于 Q2 — EyalToledano · 2026-08-27
- OpenAI 千智体自发建群引热议,GLM-5.3 与 Qwen4 同周发布 — altryne · 2026-08-27
- Opus 5 耗用 5 倍令牌才达 GPT 5.6 同等准确率 — abeirami · 2026-08-27
- AdsBench发布:Kimi K3登顶AI营销基准,成本仅$1.42/任务 — qinzytech · 2026-08-27
- 智谱 GLM 3.5 Flash 六天免费处理 42 万亿 token,全靠国产芯片 — bindureddy · 2026-08-27