AI 当编译器:模型直出 PTX 汇编,FlashAttention 提速 1.37x

Azaliamirh · x · 2026-10-01

一项新研究(由 cosfrancois 主导,与 EPFL 的 Charly Castes、Thomas Bourgeat 合作)提出「AI 即编译器」思路:让模型直接把高层源代码(如 Triton)翻译成底层汇编(如 PTX),再由验证器通过符号/数值分析校验功能正确性,并检查竞态、死锁等属性,无需手工构建多层 IR 和 DSL。

在 B200 上相对 Triton 基线的加速:

新芯片的软件栈适配一直是主要瓶颈,这条路子可能改变现状。作者称后续还有更多成果。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →