华为开源盘古2.0完整训练栈,预训练与RL代码均上线

智东西 · wechat · 2026-09-28

华为宣布盘古大模型2.0开源版 openPangu-2.0 的预训练、SFT 及后训练强化学习代码正式开源,面向昇腾集群优化,是该项目开源收官的关键一步。

核心仓库 openPanguTrainingFramework 统一支持大语言、视觉语言及多模态模型的训练,覆盖大规模预训练、分布式并行、长上下文、混合精度与监督微调等能力。RL 框架 openPangu-2.0-RL 以 VERL 为编排内核,通过昇腾亲和优化实现 Actor/Rollout/Reward 协同训练,支持 GSPO/GRPO 后训练场景。

此前华为已于6月底开源 92B 总参的 Flash 版、7月底开源 505B 总参的 Pro 版,昇腾原生训练效率提升30%。AtomGit 数据显示 Pro 版下载8834次、Flash 版下载22068次。此举配合华为「算力为核心、硬件变现」的 AI 战略。

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →