阿里 Qwen3.8 开源:2.4T 参数,激活仅 95B
Arindam_1729 · x · 2026-08-12
阿里巴巴的 Qwen3.8-2.4T-A95B 模型宣布将开放权重。该模型总参数量达到 2.4T,采用 MoE 架构,每次推理激活的参数量为 95B。
同时,Nebius Token Factory 宣布作为首发(Day 0)合作伙伴,将为该模型提供专用的托管推理服务。
所属事件:阿里发布 Qwen3.8-Max:2.4T 参数 MoE 开源(12 条相关)→
「Infra」频道最新
- 英伟达祝贺 xAI 发布 Grok 4.6:基于 GB300 训练 — elonmusk · 2026-08-13
- SK海力士砸 381 亿美元在韩国新建两座内存晶圆厂 — Beth_Kindig · 2026-08-13
- 新秀推理引擎 Tokenspeed 获 Qwen3.8 Day-0 支持 — This_Maintenance_834 · 2026-08-13
- 推演 DeepSeek V4:超低 API 成本与 SSD KV Cache 革命 — Xianbao_QIAN · 2026-08-13
- Vercel AI Gateway 零加价上线 Grok 与 DeepSeek 模型 — brandon_galang · 2026-08-13
- AI 能耗度量新视角:每 token 能耗需结合质量、任务等多维因素 — prateekj · 2026-08-13