CAKE 论文发布:编译器与智能体协同设计,Blackwell 内核提速 2.05 倍
hsu_byron · x · 2026-08-14
CAKE 论文正式发布,提出编译器与智能体协同设计的新范式。CAKE 将编译器视为可进化的 harness 的一部分,而非固定黑盒。其 IR 由智能体从生产内核语料中提炼,并随内核共同进化。在 B200 上,CAKE 在 8000 万 token 预算下达到 FlashML 的 1.144 倍性能,而直接 CUDA/PTX 仅为 0.928 倍。此外,智能体生成的 Kimi Delta Attention 内核相比官方 FlashKDA 实现取得 2.05 倍几何平均加速。
「Infra」频道最新
- OpenAI发布GPT-5.6构建者指南:账单从33美元降至1.33美元 — xiaohu · 2026-08-14
- Google免费发布GPU大师课,助你掌握硬件优化 — mdancho84 · 2026-08-14
- AMD Linux跑ComfyUI不再折腾:Docker固定ROCm运行时方案 — zychu- · 2026-08-14
- 美光科技市盈率仅9倍,AI芯片股估值引热议 — JOBhakdi · 2026-08-14
- 双 MI50 32GB 构建求助:如何配置 Hermes 与 vLLM? — opoot_ · 2026-08-14
- 零依赖推理引擎 ZSE:冷启动比 vLLM 快 30 倍,无需 PyTorch — tom_doerr · 2026-08-14