NVIDIA 首发 Qwen3.8-Flash-Next,NeMo 支持微调

Alibaba_Qwen · x · 2026-08-27

NVIDIA 宣布在发布首日即支持阿里 Qwen3.8-Flash-Next 模型。开发者可使用 NVIDIA NeMo AutoModel 和 NeMo RL 对该模型进行领域特定的微调。此外,NVIDIA 还提供了通过 sgl、vllm 和 TokenSpeed 运行该模型的 Recipes。该模型是混合注意力 MoE 架构,拥有 1250 亿参数。

所属事件:阿里开源Qwen3.8-Flash-Next:6B激活参数预览Qwen4架构(18 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →