编译器自动推导 FlashAttention:含 SMEM 与 Tensor Core 分配

vtabbott_ · x · 2026-09-12

vtabbott 转发并惊叹:有工作实现了自动推导的 FlashAttention,包括共享内存(SMEM)管理与 Tensor Core 的任务分配——即编译器/搜索系统能自动生成此前需专家手写的 GPU 注意力内核。原文链接指向具体演示。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →