SPAR3S:稀疏体素隐空间自回归模型,从稀疏视图补全生成 3D 场景
zhenjun_zhao · x · 2026-09-05
Naver 实验室的 arXiv 论文,面向「从少量无约束视图生成完整 3D 场景」这一难题。前馈重建只能输出可见内容,而 3D 生成建模受制于稠密体表示的高计算成本与大规模 3D 监督数据的稀缺。
- SPAR3S 在稀疏的体素对齐 3D 隐空间中建模,仅表示被占据的体素。
- 通过可微 3D Gaussian Splatting 的光度监督,直接从多视图图像学习该隐空间,无需真值 3D 数据。
- 训练掩码自回归 transformer 联合预测体素占据与隐 token 值,从而空间一致地补全未见区域;在合成室内场景等基准上验证有效性。
所属事件:SPAR3S 从稀疏视图自回归生成完整 3D 场景(3 条相关)→
「多模态」频道最新
- 作者实测 Seedance 与 MiniMax 的颗粒感、皮肤质感与提示词遵循 — apostraphi · 2026-09-22
- 让 AI 把整场生成实验剪成 73 秒合集,每一镜都保留 — apostraphi · 2026-09-22
- Seedance 2.0 视频逼真到「小时候真以为里面有个人」 — Terry__Poppins · 2026-09-22
- Hermes Agent 联手 ComfyUI 过夜自主迭代,做出角色替换视频 — Teknium · 2026-09-22
- VIEScore 与人类评分相关性仅 0.3,低于人与人一致的 0.45 — le_james94 · 2026-09-22
- Qwen Image 2.1 信息图文字乱码:RTX A6000 实测求助 — Porespellar · 2026-09-22