MiniMax-H3 视频修复移植 diffusers 模块化管线,6 步换主体

linoy_tsaban · x · 2026-08-22

开发者 Linoy Tsaban 将 MiniMax-H3 的 masked 视频+音频修复(inpainting)能力移植为 Diffusers 的模块化自定义 blocks(modular-diffusers),基于社区 ComfyUI 工作流改编,模型以 Apache-2.0 发布在 Hugging Face。

实测中,仅用一张参考照片 + 6 步推理即可把视频中的动物替换为参考主体,而森林、雪景、镜头推进与原声轨全部保留不动(配合 turbo LoRA 加速)。文中给出了完整的 Python 调用示例:加载 blocks、传入 mask/sourcevideo/sourceaudio 与图像参考,还提供跳过文本编码器的变体,便于把编码器拆到别处部署。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →