牛津与 NUS 推出 V-RAE:用预训练视觉表征替代像素重建做视频生成

jiqizhixin · x · 2026-09-03

牛津大学与新加坡国立大学提出 V-RAE(Video Representation Autoencoder),重新思考视频生成的基础。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →