GAE 发布:在几何原生潜空间直接生成视频与 3D 点云
yshan2u · x · 2026-09-22
CUHK 团队推出生成模型 GAE,强调其输出是「3D 原生生成」而非事后从 RGB 重建 3D。
- GAE 将几何基础模型的特征压缩进一个共享潜空间,条件流模型直接在该空间中生成,同一潜变量同时解码出 RGB 外观与 3D 点云几何。
- 关键设计在于「生成发生在哪个空间」:由于几何特征经基础模型压缩,外观与几何天然对齐,最终状态一次性解码两种模态。
- 演示包括相机条件的世界生成与文生图配对结果,展示点云为原生生成而非从 RGB 反推。
代码与模型已开源,项目页已上线。
「多模态」频道最新
- SenseNova U1.5 Lite 多参考图融合实测小幅胜过 FLUX.2-klein-9b — Kakash1i · 2026-09-22
- 博主用 CREAO Agent 一行输入跑通完整短片生成管线 — socialwithaayan · 2026-09-22
- AI 虚拟歌手 YURI 上海演唱会:百米巨幕呈现终曲 SURREAL — hq4ai · 2026-09-22
- 用 AI 把人体运动堆叠成 3D 时空体积,可视化效果如催眠般迷人 — CurieuxExplorer · 2026-09-22
- Reddit 导演求助:视频换背景后如何让演员光照匹配新场景 — ItsLukeHill · 2026-09-22
- 社区讨论:Qwen Image 2.1 能否像 H3 一样接上 refmods 工作流 — CranberryBeautiful76 · 2026-09-22