Minimax H3 技巧:用 latent 加噪声解锁参考图的更多变化
neph1010 · reddit · 2026-09-16
作者分享 Minimax H3(ref2va)参考图控制的进阶玩法:该模型对参考图非常「字面」,想要「类似但不完全一样」的效果时很受限制。解法是绕过图像输入,改用 latent 加噪声:
- 原理:对图像加噪只是可见噪点;在 latent 空间加噪则给采样器探索相邻概念的自由。把空 latent(全噪声)与原 latent 混合即可。
- 参数经验:latent strength 0.38 时仍偏块状;0.35 左右是甜点位——保留构图、纹理自然重构;0.25 以下则构图也开始偏离,接近无参考输出。注意衰减很陡,具体数值随 prompt、sampler、LoRA 而变。
- 实现:原生节点不支持 latent 输入,作者改写了 ComfyUI 节点加上 latent 输入口,并开源在 GitHub(comfyui-minimaxh3-condition-latent)。
同样的 latent-as-reference 手法对 Flux2 Klein 也适用。
「多模态」频道最新
- Creatify 广告视频模型 Boreal 上架 fal:2K 分辨率最长 20 秒 — Scobleizer · 2026-09-16
- RTX 5070 Ti 实测开源音乐模型 YuE2:130 秒生成 4 分钟歌曲 — Downtown-Cover-7422 · 2026-09-16
- LAION 联手推出配音竞技场:同场对戏盲测 TTS 模型表现 — realmrfakename · 2026-09-16
- Hugging Face 新教程:零数学门槛图解 Flow Matching 原理 — Hugging Face · 2026-09-16
- 两人用 AI 拍出 8 分钟动作喜剧,自演双主角放预告 — Muted_Camp352 · 2026-09-16
- Three.js+TSL 打造宁静海岸世界 Tideglass Cove 并开源 — techartist_ · 2026-09-16