阿里发布 Qwen3.8-Flash 预览版,架构升级成本大降
Alibaba_Qwen · x · 2026-08-26
阿里云发布 Qwen3.8-Flash 多模态 MoE 模型,作为 Qwen4 架构的早期预览。该模型拥有 125B 参数,但每 Token 仅激活 6B 参数,实现极致性价比。新架构引入 GDN+QSA 混合注意力、N-gram Embedding 和 Muon 优化器,训练成本仅为 Qwen3.7-Plus 的 1/9。性能方面,在 DeepSWE、SWE-bench Pro 和 MathVision 等基准测试中表现强劲。正式版将通过 QwenCloud API 提供,定价低至输入 $0.16/1M tokens、输出 $0.47/1M tokens。
所属事件:阿里发布Qwen3.8-Flash(Next):125B稀疏MoE预览Qwen4架构(7 条相关)→
「Infra」频道最新
- 企业部署 AI 是否正在为性能过度付费? — ysuresh_91 · 2026-08-26
- AWS 宣布收购 DuckDB,布局分析型数据库 — onderkalaci · 2026-08-26
- CPU vs GPU vs TPU:5 种 AI 硬件架构详解 — HankYeomans · 2026-08-26
- 印度仅占全球总算力 0.2%,算力基础薄弱 — himanshustwts · 2026-08-26
- Linux 基金会庆 35 周年,开源模式剑指 AI — 0xsachi · 2026-08-26
- Facefusion 安卓端开源,视频换脸跑通骁龙 NPU — Few_Caregiver8134 · 2026-08-26