Cursor 发布 MoE 训练 megakernel,宣称算力近乎翻倍
CapnHat · reddit · 2026-08-05
Cursor 官方发布了名为 Mixture-of-Kittens 的全新 megakernel,专门用于训练混合专家模型。官方宣称该技术能够近乎翻倍 TFLOP/s 的性能表现,为 MoE 架构挤出更多算力红利。
项目已在 GitHub 开源,社区可以尝试将其应用于喜欢的 MoE 模型上进行性能压榨。
所属事件:Cursor开源MoE训练算子MoK,NVL72算力近乎翻倍(5 条相关)→
「Infra」频道最新
- 128GB 内存 Mac 跑本地大模型,哪款最适合写代码? — Electronic_Back1502 · 2026-08-05
- Artificial Analysis 推出端点精度指数:GLM-5.2 等模型 API 精度差异显著 — ArtificialAnlys · 2026-08-05
- Normal Computing 发布热力学数字计算机 CN101 架构论文 — ColesThermoAI · 2026-08-05
- a16z 领投 Volta A 轮,打造初创企业专属 AI 算力云 — a16z · 2026-08-05
- 英伟达战略转型:从卖芯片到赚取云计算分成 — GavinSBaker · 2026-08-05
- llama.cpp新PR:缓存MoE热门专家,8GB显存推理速度翻倍 — BTA_Labs · 2026-08-05