MiniMax H3 混合模型:首帧与参考图兼得
Tokey_TheBear · reddit · 2026-08-17
用户分享了 MiniMax H3 的混合模型(FL2VA + REF2VA),解决了官方模型无法同时高质量锁定首帧位置并使用额外参考图的问题。
核心方案:
- 使用 fl2va 作为基础以保证质量,融合 ref2va 的 transformer blocks 以支持参考图。
- 模型 b20-49 适合参考图一致性要求高的场景(如字模、特定静帧),b30-49 则更追求原始画质。
应用模式:
- 模式 A(首帧+符号参考):在保持首帧场景锁定的同时,仅将第二张图(如 Logo)作为符号参考嵌入画面,而不将其转化为视频帧。
- 模式 B(多时间点硬切):实现在 0s/3s/6s 三个时间点精确切换不同的静态画面,填补了原生 FL2VA 仅支持首尾锁定的空白。
该方案通过特定的提示词格式(如 fullypreserved)和 ComfyUI 接线实现。
「多模态」频道最新
- Minimax H3是否必须严格遵循原生1344x768分辨率? — rm_rf_all_files · 2026-08-17
- 寻求优化Minimax H3图生视频提示词的工具 — waseem335 · 2026-08-17
- 求助:Minimax H3如何成功实现参考图风格转换? — Adventurous-Gold6413 · 2026-08-17
- 零建模:Opus 5一键生成1999街机风游戏 — RanaHanocka · 2026-08-17
- 用Flux和H3参考模型制作AI新闻播报短片 — JuniorEnsign · 2026-08-17
- Minimax H3本地运行实测:4070 Ti Super生成6秒视频耗时38分钟 — Azhram · 2026-08-17