NUS 发布 V-RAE:重构视频潜空间提升生成质量

NationalUniversityofSingapore · hf · 2026-08-19

新加坡国立大学发布了 V-RAE 模型。该方法重新思考了视频的潜空间表示,通过冻结的视觉表征构建语义化的视频潜在变量,旨在提升视频生成质量、收敛速度以及预测建模能力。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →