Alibaba Open Sources Qwen3.8-Flash: Undercuts DeepSeek, Runs 1M Context on 4090

量子位 · wechat · 2026-08-28

Alibaba Qwen released and open-sourced Qwen3.8-Flash, a 125B MoE model activating 6B parameters per token. It natively supports 262k context, extendable to 1M tokens.

Key Highlights:

Original post →

More from Infra

Infra channel →