SQuad 论文:将视频生成注意力计算加速 67 倍

jm_alexia · x · 2026-08-19

论文提出 SQuad (Sub-Quadratic Attention Distillation) 框架,将视频生成中的 Self-Attention 复杂度从 O(N²) 降低至 O(N√N)。通过两阶段蒸馏(Flow-Matching SFT 和改进的 DMD2),在不牺牲质量(VBench 得分 83.20 vs 83.08)的情况下,在 Wan 2.2 5B 模型上实现了单步每块注意力 FLOPs 减少约 67 倍,延迟降低约 11 倍。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →