Zyphra 优化 MoE 专家路由通信,AMD MI300X 上提速至 2.63 倍

QuentinAnthon15 · x · 2026-10-09

Zyphra 研究团队指出,在 MoE(混合专家)模型中,把 token 传输到对应专家的通信开销可能主导总运行时间。他们利用 token 路由模式的规律来加速这一通信过程,在不改动模型本身的情况下,在 AMD MI300X GPU 上实现了最高 2.63 倍的通信提速。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →