DiffGI 用可微几何图像提升薄壳 3D 生成质量
clovir21 · hf · 2026-07-21
# DiffGI:把 3D 形状压进可微几何图像里 这篇论文针对 **薄壳结构** 和 **非流形几何**(比如服装)难以生成的问题,指出传统隐式体素/体积表示常常天然偏向“封闭实体”,因此不擅长表达这类表面型结构。 核心方法是: - 用连续的 **2D TSDF** 取代二值几何图像,让边界位置能以亚像素精度保留。 - 设计 **可微 Marching Squares**,让 3D 表面损失可以反向传播到 2D 潜空间。 - 在此基础上训练一个带几何感知法线渲染损失的 **DiffGI-VAE**,把复杂 3D 表面压缩到 `32×32` 的超紧凑潜空间。 - 再在该潜空间上训练基于 transformer 的 latent diffusion,并用 flow-matching 做条件 3D 生成。 实验显示,在服装和物体数据集上,DiffGI 的重建保真度和边界精度都优于既有几何图像与体素方法,而且计算开销更小。
「多模态」频道最新
- MiniCPM-V 4.6 已可在 iPhone 本地运行,无需云端依赖 — amos_gyamfi · 2026-07-21
- 他不再用相机拍摄,而是直接用提示词“出片” — taherdhanera · 2026-07-21
- PixVerse 做出一支完整火星科幻黑色喜剧短片 — aliscodes · 2026-07-21
- 阿里 Qwen-Audio-3.0-TTS-Plus 登顶 Speech Arena 榜单 — airesearch12 · 2026-07-21
- Reddit 用户称 anima_turbo 出图更亮,速度也更快 — DeliciousMoraxMora · 2026-07-21
- Qwen 发布 Qwen-Image-3.0,主打更真实细节与内容密度 — ilreb · 2026-07-21