NVIDIA BioNeMo 优化 MoE 训练,Mixtral 吞吐提升 2.21 倍

NVIDIA BioNeMo 团队针对稀疏 AI(MoE 类模型)的 GPU 执行效率推出优化方案,旨在加速生物基础模型的高效训练。实测显示,在 8 张 B200 GPU 上,Mixtral-8x7B 的训练吞吐相比 Hugging Face BF16 基线最高提升 2.21 倍,展示了新硬件与软件协同优化对大规模稀疏模型训练的显著加速效果。

2026-09-29 ~ 2026-09-29 · 2 条相关