Cursor 开源 MoK:专为 NVL72 打造的 MoE 训练 Megakernel
StasBekman · x · 2026-08-05
Cursor 宣布开源 Mixture-of-Kittens (MoK),这是一个专为 GB300 NVL72 架构设计的、完全确定性的混合专家模型训练 Megakernel。
核心优化与背景
- 瓶颈融合:随着其智能体编码模型 Composer 的扩展,MoE 层已成为消耗一半以上端到端训练时间的主要瓶颈。MoK 将所有 MoE 通信和计算融合到单个内核中解决此问题。
- 架构适配:NVL72 是单 NVLink 域内的多节点机架,支持跨 72 个 GPU 的快速细粒度重叠。此外,GB300 集成的 Grace CPU 相对较慢,这也促使了计算与通信的深度重构。
- 生产验证:MoK 目前已支持 Composer 模型在数以万计的 GPU 上进行训练。
所属事件:Cursor开源MoE训练算子MoK,NVL72算力近乎翻倍(5 条相关)→
「Infra」频道最新
- AMD 宣称 Helios 架构性价比碾压英伟达 Vera Rubin — Beth_Kindig · 2026-08-05
- 日均烧 13 万美元?DeepSeek API 真实调用量揭秘 — teortaxesTex · 2026-08-05
- 美国 NSF 斥资 1 亿美元建设区域性 AI 基础设施中心 — mkratsios47 · 2026-08-05
- Chutes AI 全面启用 TEE 验证,8x RTX 5090 算力性价比超专业卡 — markjeffrey · 2026-08-05
- engyai 上线 OpenRouter 最廉价 Kimi K3 API,成本降半 — const_reborn · 2026-08-05
- LiquidAI 新模型实测:Mac 本地跑 128K 上下文解码达 82 tok/s — helloiamleonie · 2026-08-05