视频扩散模型实现单张图像重新对焦
CSProfKGD · x · 2026-08-13
Adobe Research 等机构提出了一种基于视频扩散模型(Video Diffusion)的图像重新对焦新方法。
- 核心思路:将单张失焦图像转化为连续的焦距堆栈(表示为视频序列),利用视频扩散模型对焦点转移的强大先验知识,实现交互式的后处理重新对焦。
- 技术优势:在感知质量和鲁棒性上均优于现有方法,能够处理各种复杂的真实拍摄场景。
- 开源资源:团队同步发布了大规模的真实智能手机焦距堆栈数据集,以支持相关领域的后续研究。
该论文已被 SIGGRAPH Asia 2025 接收。
「多模态」频道最新
- 实测 MiniMax 新模型:基于个人漫画创作图生视频 — Just_Second9861 · 2026-08-13
- 视频生成模型翻车:难以连贯呈现“戴手铐”等复杂物理交互 — flowersslop · 2026-08-13
- LTX 2.5 视频生成实测:构建儿童故事工作流 — pfeifits · 2026-08-13
- GPT-4o 展现惊人像素级图像取证能力 — teortaxesTex · 2026-08-13
- 高通专家谈图像生成瓶颈:光堆算力不够,需分离规划与渲染 — TWIML AI Podcast · 2026-08-13
- Runway 宣布接入 xAI 的 Grok Imagine Image 2.0 模型 — runwayml · 2026-08-13