FixAnything:稀疏点云加 20 段视频微调,视频模型统一修复 3D 渲染
kwangmoo_yi · x · 2026-08-26
CMU 团队(Vuong、Ramanan、Narasimhan)的 FixAnything(ECCV 2026)提出用单一通用视频模型修复任意 3D 表示的渲染伪影:
- 核心思路:把修复视为 video-to-video 翻译。3DGS/NeRF/mesh/点云渲染各有伪影,但渲染保留了相机轨迹和粗略场景布局,正好作为视频扩散模型(Wan2.1-I2V-14B)的控制信号
- 数据效率:极稀疏点云(如 COLMAP 输出)即可提供有效相机控制,只需约 20 段成对视频做最小 LoRA 微调
- 对齐方法:用 COLMAP 从输出恢复的相机位姿作为奖励,通过 Flow-DPO 引导模型输出几何一致的结果
- 锚点机制:轨迹经过的干净训练视角被当作锚点,模型将外观、光照与场景结构传播到中间的退化帧
所属事件:FixAnything 用视频生成先验统一修复 3D 渲染伪影(2 条相关)→
「多模态」频道最新
- LAION-BVD:千万小时多模态预训练视频数据集 — Andreas Hochlehnert · 2026-08-26
- Reddit 用户用 AI 生成动画短片剧集《Realmz of the Redeemers》 — Kindly_Poet_7878 · 2026-08-26
- RTX 3070 上生成美国队长大战哈利波特:每 10 秒视频约 10 分钟 — luka06111 · 2026-08-26
- Reddit 用户分享暗黑奇幻风格 AI 生成视频片段 — Illustrious_Fee_3676 · 2026-08-26
- 让 Claude 搭建提示词模板系统批量生成 ComfyUI 工作流,5 分钟视频 2 小时重渲 — spikyness27 · 2026-08-26
- Qwen Image Edit 疑似按 1MP 训练:输入缩到 1024×1024 效果显著更好 — Civil_Fee_7862 · 2026-08-26