FixAnything:用视频生成先验统一修复 3D 渲染伪影
gabriel1 · x · 2026-08-26
FixAnything 是一个通用视频模型,旨在修复来自任何 3D 表征(3DGS、NeRF、网格或稀疏点云)的渲染伪影。
核心原理与方法:
- 视频到视频转换:将修复问题重构为视频到视频的翻译任务,通过微调预训练视频扩散模型(Wan2.1-I2V-14B)实现。
- 稀疏点云控制:即使是极其稀疏的点云(如来自 COLMAP)也能为视频模型提供有效的相机控制信号,仅需约 20 个配对视频进行 LoRA 微调。
- 几何一致性奖励:使用 COLMAP 从输出中恢复的相机位姿作为奖励,通过 Flow-DPO 引导模型生成几何一致的输出。
- 锚定机制:模型将训练轨迹中经过的清晰视图视为锚点,将外观、光照和场景结构传播到中间的降质帧中。
该论文已收录于 ECCV 2026。
所属事件:FixAnything 用视频生成先验统一修复 3D 渲染伪影(2 条相关)→
「多模态」频道最新
- 正式宣布:视频模型进入「后训练时代」 — gorkem · 2026-08-26
- AI 一键给人像重打光:不换脸直接出商业大片质感 — sven_ai · 2026-08-26
- NoSpoon H3 音乐视频 Agent 开测:三条生成拼成多机位成片 — Kyrannio · 2026-08-26
- sanoTTS:140 万参数模型在 $3 芯片上实时运行 — kastnerkyle · 2026-08-26
- 本周新模型盘点:视觉编码器与机器人基础模型 — TheTuringPost · 2026-08-26
- HYPERREALITY 发布第二支预告片 — Listen_Expert · 2026-08-26