单张图片重建整座城市:自适应分块方法让 3D 场景生成突破室内局限
Jiraphon Yenphraphai · hf · 2026-10-07
研究者提出一种将物体级 3D 生成器(如 Trellis 2)改造为从单张图片生成完整 3D 场景网格的方法,覆盖相机未观测到的表面,室内外通吃。
关键做法:
- 自适应分块:按与相机距离划分场景 chunk——近处 chunk 小以保留细节,远处建筑等由大 chunk 覆盖;
- 显式 2D-3D 对应:提升图像特征,让模型感知自由空间、已观测表面与未观测区域;
- 合成约 4000 个室外场景,弥补现有场景数据集偏室内的短板。
在 Tanks and Temples、ScanNet++ 及真实 wild 图像上,该方法的几何精度与感知质量全面超越基线。
「多模态」频道最新
- 揭秘 Claude Opus 5.5 做视频:核心是模型写程序来画 — dotey · 2026-10-07
- ComfyUI Qwen 图像增强节点新增参考图局部遮罩控制 — Capitan01R- · 2026-10-07
- DRAMA 1.0 发布:只改表情层,已拍视频一键切换 10 种情绪 — nikola_mr64990 · 2026-10-07
- 10.5k 星 video-shotcraft:用 Claude Code 自动产出电影感产品视频 — tom_doerr · 2026-10-07
- 实测称 Nano Banana 2.1 更便宜、快 5 倍且强于 ChatGPT 图像 — prajdabre · 2026-10-07
- 字节提出 DuoMatching:少步数视频生成人类偏好超 80% — ByteDance · 2026-10-07