SANA-Video 2.0 用混合注意力拿下 84.30 分并大幅提速

danijarh · x · 2026-07-24

SANA-Video 2.0 是一款主打效率的视频生成模型,同时强调画质不缩水。

团队给出的关键技术点包括:混合线性-Softmax 注意力、Block Attention Residuals,以及自研的 Sol-Engine 加速栈。训练方面,他们称在资源很有限的情况下,从头训练了统一的 5B 和 14B 两个版本:5B 只用了 16 个 H100 节点,14B 用了 48 个 B200 节点。

官方公布的结果包括:

这条帖子的核心信息是:高质量 720p 视频生成可以通过更激进的结构与系统优化,在更少资源下做得更快。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →