NUS 发布 V-RAE:重构视频潜空间提升生成质量
NationalUniversityofSingapore · hf · 2026-08-19
新加坡国立大学发布了 V-RAE 模型。该方法重新思考了视频的潜空间表示,通过冻结的视觉表征构建语义化的视频潜在变量,旨在提升视频生成质量、收敛速度以及预测建模能力。
「多模态」频道最新
- 提取首帧做降噪参考,修复视频色彩与细节 — DuHal9000 · 2026-08-19
- MiniMax H3 单次生成超宽画面:一帧塞进两个故事 — SIR_NVAX_A_LOT · 2026-08-19
- 小米开源 ControlFoley 模型:视频生成音频 — apolinariosteps · 2026-08-19
- Minimax H3 生成“生活大爆炸”角色拟人化视频 — MisterViral · 2026-08-19
- AI 将梅西等球星重绘为龙珠角色 — aitrendz_xyz · 2026-08-19
- Seedance 提示词复刻 2000 年代日系 Vlog 风格 — eyishazyer · 2026-08-19