NVIDIA 推出 Axolotl3D:多模态遮挡感知的 3D 补全模型
NVIDIAAI · x · 2026-09-17
NVIDIA 研究团队在 ECCV 2026 发布 Axolotl3D,一个多模态、遮挡感知的 3D 形状补全模型。
核心思路
- 现有 3D 生成模型多假设单视角、完整可见,Axolotl3D 联合条件化于图像、可见性掩码、相机参数与部分点云
- 点云作为几何锚点保证补全的几何忠实性;相机参数保证多视角在共享 3D 坐标系下对齐
- 统一训练策略从大规模 3D 数据合成多种条件组合,微调 Hunyuan3D-DiT 后经 ShapeVAE 解码
实验结果
- 在 Toys4K 和 OmniObject3D 上,干净与遮挡场景均达到 SOTA
- 真实场景重建与几何一致编辑也有强表现
「多模态」频道最新
- SuperSplat 新增场景 splat 数量查看,旧场景将回填 — willeastcott · 2026-09-17
- LoRA 训练工具 ai-toolkit 上架 Pinokio,支持一键安装 — cocktailpeanut · 2026-09-17
- 用 AI 建模 Blender 的技巧:分部件建模再拼装更有效 — kevinkern · 2026-09-17
- 语音 AI 的胜负手:延迟和响应性或与智力同等重要 — VraserX · 2026-09-17
- 网易有道开源 Confucius R2T2:160ms 流式切片边说边懂语音 — VraserX · 2026-09-17
- 开源 Maestro 一键本地 AI 创作室:写词生曲剪片全免费 — cocktailpeanut · 2026-09-17