Cursor 开源 MoE 训练加速内核,B200 端到端提速约 40%
Dany0 · reddit · 2026-08-06
Cursor 开源 MoE 训练加速内核
Cursor 团队开源了一款针对 MoE(混合专家模型)训练的更快 megakernel,专为 B200 GPU 优化。
性能表现
- 官方数据:声称端到端(e2e)速度提升约 40%,前向传播速度提升约 140%。
- 作者实测观点:发帖人提醒不要盲信 benchmark,建议自行运行测试。他推测,相比于普通人手写的简单内核,该内核在实际应用中的端到端提速大约在 10%-20% 左右。
该项目采用 Apache 2.0 开源协议发布,对社区免费可用。
所属事件:Cursor 开源 MoE 训练算子 MoK,算力近乎翻倍(7 条相关)→
「Infra」频道最新
- 企业部署AI的灵魂拷问:你的AI到底跑在哪里? — DavidLinthicum · 2026-08-06
- AI 推理需求年增十倍,算力短缺将成常态 — TansuYegen · 2026-08-06
- 企业数据无法迁移,AI 战略沦为纸上谈兵 — DavidLinthicum · 2026-08-06
- Mac本地跑大模型:Nativ支持LiquidAI LFM2.5,8.5GB内存跑满128K上下文 — JosephJacks_ · 2026-08-06
- 初创公司 Panthalassa 研发波浪能漂浮 AI 数据中心 — TinfoilTricorn · 2026-08-06
- 单张 GH200 跑出近万吞吐量,Maple 20B 开放免费推理端点 — MaziyarPanahi · 2026-08-06