Cursor Open-Sources MoK Megakernel, Nearly Doubling NVL72 MoE Performance

Cursor 宣布开源名为 Mixture-of-Kittens (MoK) 的混合专家模型(MoE)训练超级算子,专为 GB300 NVL72 架构设计。官方宣称该技术能将近乎翻倍 TFLOP/s 的性能表现,为 MoE 架构提供显著的算力红利,引发业界对大规模模型训练效率的关注。

已确认

为什么重要

随着大模型参数与规模指数级增长,MoE 架构的跨设备通信与计算瓶颈成为限制算力释放的关键。MoK 通过极致的内核融合方案,显著提升了 NVL72 系统的训练吞吐量,为降低超大模型训练成本和提升硬件利用率提供了重要的技术路径。

2026-08-05 ~ 2026-08-05 · 5 related posts

Primary sources

2 near-duplicate retellings: StasBekman · nicolascraske