苹果发布 STARFlow-V:首个基于归一化流的因果视频生成模型

thoma_gu · x · 2026-09-01

Apple 团队发布 STARFlow-V,首个基于归一化流(Normalizing Flow)的因果视频生成模型,证明不靠 diffusion 也能在视觉质量上匹敌视频扩散模型。

核心设计:

背景是近期讨论「多数『自回归视频』其实是双向短片段 DiT 加因果掩码蒸馏」的声音,本文给出了另一条路线。论文与代码已公开。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →