NVIDIA Sol-Attn 让视频生成端到端提速最高 5.08 倍
songhan_mit · x · 2026-07-28
Sol-Attn 用训练无关稀疏注意力,把视频生成加速到 5 倍
NVIDIA Research 发布 Sol-Attn,一种无需训练的稀疏注意力方法,目标是在尽量保持画质的前提下,加速预训练视觉生成模型。
- 方法把动态路由、稀疏计算和近似校正统一进一次 online-softmax 流程里。
- 通过在线块阈值筛选控制计算预算,并复用未选中块的 proxy score 来保留长尾贡献。
- 论文给出的端到端提速结果(相对 dense FlashAttention-3):
- Wan 2.1-14B:2.02×
- HunyuanVideo-13B:2.12×
- LTX 2.3:最高 2.4×
- 接入 Sol-Engine(结合 kernel fusion 和 caching)后,速度提升进一步扩大:
- Wan 2.1-14B:3.48×
- HunyuanVideo-13B:5.08×
NVIDIA 表示这套能力已经可用,B200 kernel 还在继续优化。帖子同时给出了项目、论文和代码链接。
「多模态」频道最新
- 一套可复用的 AI 动漫流程:角色卡、分镜到 GPT Image 2.0 — aftahi_ai · 2026-07-28
- Seedance 2.0 实测:原神风格视频生成效果很亮眼 — aziz4ai · 2026-07-28
- 西班牙语AI媒体生成视频教程系列上线,从基础到进阶 — Botoni · 2026-07-28
- 爆料称 Grok Imagine 将升级为多模态一体创作流 — XFreeze · 2026-07-28
- ACE-Step UI 号称可本地生成 4 分钟带人声歌曲 — anselm · 2026-07-28
- Reddit 用户用 LoRA 和 ComfyUI 做出 Wan 2.2 连续生成流程 — SnooMacaroons1365 · 2026-07-28