MiniMax-H3 视频修复移植 diffusers 模块化管线,6 步换主体
linoy_tsaban · x · 2026-08-22
开发者 Linoy Tsaban 将 MiniMax-H3 的 masked 视频+音频修复(inpainting)能力移植为 Diffusers 的模块化自定义 blocks(modular-diffusers),基于社区 ComfyUI 工作流改编,模型以 Apache-2.0 发布在 Hugging Face。
实测中,仅用一张参考照片 + 6 步推理即可把视频中的动物替换为参考主体,而森林、雪景、镜头推进与原声轨全部保留不动(配合 turbo LoRA 加速)。文中给出了完整的 Python 调用示例:加载 blocks、传入 mask/sourcevideo/sourceaudio 与图像参考,还提供跳过文本编码器的变体,便于把编码器拆到别处部署。
「编程与Agent」频道最新
- 开发者吐槽:闭源模型隐藏思维链害苦了 Agent — johnnyApplePRNG · 2026-08-22
- Agent 分三层:业务逻辑、循环框架、生产级基础设施 — blaizedsouza · 2026-08-22
- Every Agent 获计算机控制能力,实测 Token 消耗过高 — every · 2026-08-22
- Grok Build 1.0.8 发布:子智能体并发启动提速不再卡死主会话 — kevinnbass · 2026-08-22
- GitHub 热门:整理数百个 Claude 定制技能与资源 — tom_doerr · 2026-08-22
- Ox Alpha 模型实测:在 Pi Harness 中表现惊艳 — omarsar0 · 2026-08-22