PWT 稀疏注意力新法:无需微调,视频生成端到端提速 2.5 倍

青稞AI · wechat · 2026-07-31

本文深入探讨了注意力机制的优化路径,指出稀疏注意力(丢弃低权重)与线性注意力(整体线性近似)具有天然的互补性。

作者解析了 SLA 和 PISA 等现有方案,并提出了一种名为 PWT(Piecewise-Taylor) 的改进方法。PWT 通过引入二阶泰勒展开项,弥补了 PISA 仅有零阶近似的缺陷,利用块内协方差矩阵修正了质量低估问题。

核心优势与细节:

PWT 的前向与反向 Kernel 实现已开源。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →