HyperParallel FSDP2+Muon 在华为昇腾上训练吞吐显著超 PyTorch FSDP2

PyTorch · x · 2026-09-09

PyTorch 官方宣布 HyperParallel——一个面向 Ascend SuperPoD 优化的基于 PyTorch 的分布式加速库。在相同配置下,HyperParallel FSDP2 + Muon 相比 PyTorch FSDP2 + Muon 带来明显更高的训练吞吐,同时保持一致的 loss 收敛。

该结果在 PyTorchCon China 主题演讲中现场演示:使用华为 Atlas 800T 集群跑 Qwen3-30B-A3B 训练任务,展示完整分布式训练工作流,并动态可视化吞吐与 loss 收敛曲线。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →