魔改 MiniMax H3 做单图编辑,附 ComfyUI 完整工作流
Patient_Ratio4177 · reddit · 2026-08-14
开发者分享了将视频模型 MiniMax H3 用于单图编辑的完整 ComfyUI 实践方案。
- 核心组件:使用混合了 FL2VA 与 Ref2VA 优势的 Checkpoint,配合专门用于渲染单图的 Video VAE,以解决直接抽取视频首帧导致的模糊和网格伪影问题。
- 工程细节:提供了修改后的 nodesminimaxh3.py 文件以绕过 ComfyUI 最少生成 5 帧的限制;推荐搭配 ThisIsFine LoRA 提升细节,以及 Turbo LoRA 加速生成。
- 性能与效果:在 RTX 5090 上生成 1920×1088 图像仅需约 8 秒。作者指出该方法在角色一致性、3D 场景处理和构图上超越了此前的 Krea 2 方案,支持换装、改变体型、风格化及基于深度图的重摆姿势。
「多模态」频道最新
- CVPR 2026 论文 PersonaLive:面向直播的肖像动画生成 — rsasaki0109 · 2026-08-14
- Seedance 2.5登陆CapCut,3分钟视频挑战赛奖金8万美元 — Aiden_Tech_Ai · 2026-08-14
- Seedance 2.5全球上线CapCut,3分钟视频挑战赛奖金8万美元 — Aiden_Tech_Ai · 2026-08-14
- Midjourney 提示词分享:六帧不完美画面构成一个事件 — tisch_eins · 2026-08-14
- 多模态 AI 已覆盖 60% 企业应用,但家用电器仍停留在“AI 模式” — shashib · 2026-08-14
- Seedance 2.5 上线 1080p 视频生成,新用户限时免费 — SimplyAnnisa · 2026-08-14