讯飞星火X2.5全靠万卡国产910B训练,机器有效时长超97%

机器之心 · wechat · 2026-09-11

机器之心深度解析科大讯飞星火X2.5(MoE架构,293B-A30B)如何在万卡国产910B集群上完成预训练与后训练,并披露万卡国产算力的四大工程挑战与解法:

模型侧通过多教师在线策略蒸馏(MOPD)整合多领域教师优势,强化代码与智能体能力。在DSA稀疏注意力算子优化案例中,星火X2.5通过约1600次工具调用,相比torchnpu实现取得3.5倍加速——模型开始反过来参与NPU底层算子优化,形成「国产算力训练模型→模型优化算子→反哺训练」的反馈循环。团队还在寒武纪MLU590、中科海光BW1000等国产芯片上开展适配。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →