Qwen3.8-Flash 开源:卷死 DeepSeek,4090 跑 1M 上下文

量子位 · wechat · 2026-08-28

阿里千问发布并开源 Qwen3.8-Flash 模型,采用 125B MoE 架构,每 Token 激活约 6B 参数。该模型原生支持 262k 上下文,可扩展至 1M token。

核心亮点:

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →