NVIDIA 首发 Qwen3.8-Flash-Next,NeMo 支持微调
Alibaba_Qwen · x · 2026-08-27
NVIDIA 宣布在发布首日即支持阿里 Qwen3.8-Flash-Next 模型。开发者可使用 NVIDIA NeMo AutoModel 和 NeMo RL 对该模型进行领域特定的微调。此外,NVIDIA 还提供了通过 sgl、vllm 和 TokenSpeed 运行该模型的 Recipes。该模型是混合注意力 MoE 架构,拥有 1250 亿参数。
所属事件:阿里开源Qwen3.8-Flash-Next:6B激活参数预览Qwen4架构(18 条相关)→
「Infra」频道最新
- 视频生成提速300倍:Jevons悖论下的创作可能 — gorkem · 2026-08-27
- 卫报播客:人人都讨厌数据中心,但我们真的离不开它吗 — nordicinst · 2026-08-27
- 分析英伟达策略:是回购股票还是重仓 HBM — toptickcrypto · 2026-08-27
- TokenSpeed 首日支持 Qwen 3.8 Flash Next — Alibaba_Qwen · 2026-08-27
- Z.ai 日用万亿 Token,国产算力或已具备训练能力 — SumitGup · 2026-08-27
- DLSS 4.5 发布:二代联合降噪超分模型,同算力画质显著提升 — ctnzr · 2026-08-27