MPK 更新:面向LLM的Megakernel编译
JiaZhihao · x · 2026-07-15
MPK 发布一周年,作者更新了几个进展:
- 计划在 OSDI 2026 上介绍如何把 LLM 编译成单一 megakernel。
- 运行时已为 Blackwell 重新构建,后续会发布更快、更精简的 megakernel 版本。
- 社区已经把 megakernel 扩展到更多硬件后端,文中还提到 AMD MI350X 的移植。
- 项目已有 50+ 贡献者参与。
引用内容补充了 MPK 的核心思路:把 LLM 的计算与通信融合进一个 GPU megakernel,以降低手写 megakernel 的难度,并宣称可把延迟降低 1.2–6.7 倍。
「Infra」频道最新
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- SF Compute 创始人:现在买算力是「绝对糟糕的体验」 — IgorCarron · 2026-09-11
- 开源 SmolVM:2026 年 Agent 不止用浏览器,而是拥有整台电脑 — aniketmaurya · 2026-09-11
- PyTorch Day Korea 2026 首届线下大会启动,9月13日截止征集演讲 — PyTorch · 2026-09-11
- 本地跑 LLM 选卡:4 张 CMP-170HX 涨价 vs Mac Studio M5 — rumboll · 2026-09-11
- llama.cpp 为 RDNA4 调优 Flash Attention,大上下文提升明显 — pmttyji · 2026-09-11