单图前馈生成 3D 场景,SceneGen 代码与模型全开源
tom_doerr · x · 2026-08-10
SceneGen 是一篇被 3DV 2026 接收的论文,提出了一种仅需单张图片即可在单次前馈传播中生成完整 3D 场景的新架构。
目前,该项目的训练代码、推理代码、数据处理工具以及预训练模型已全部在 GitHub 上开源。开发者已准备好硬件(如 NVIDIA GPU)即可部署和复现。
「多模态」频道最新
- 探讨视频生成中稳定的参考图角色替换工作流 — Wonderful-Tough7215 · 2026-08-10
- 实测 Seedance 2.5 模型:30秒多参考视频生成,风格一致性极佳 — CurieuxExplorer · 2026-08-10
- AI 隐身模式:展示令人惊叹的视频生成一致性 — ThAIandTed · 2026-08-10
- 谷歌 XR 开源参数化人体模型 GNM,社区实现交互式重建 — leland_mcinnes · 2026-08-10
- SIGGRAPH 2025论文:Blur2Vid让老照片动起来 — cindy_x_wu · 2026-08-10
- 利用 Seedance 2.5 制作长视频:虚拟香水广告创意实测 — JeffSynthesized · 2026-08-10