Minimax H3 原生音视频同步生成实战解析
CommentSignal9029 · reddit · 2026-08-31
作者使用 Minimax H3 模型制作了短片《IN TRANSIT》,探索“野兽派频率”的视觉风格。工作流完全在 ComfyUI 中完成,分为两步:
- 生成:利用 Ollama (Gemma4:26b) 节点优化提示词,配合 Spectrum Apply、Comfy Kitchen 等优化节点在 864x480 分辨率下生成基础视频。
- 潜空间放大:使用自定义 MMH3Tools 节点,在潜空间将视频提升至 1344x768,保持混凝土粗糙质感且不产生塑料感。
核心挑战在于实现原生音视频同步,模型能根据参考声音(如真空吸力)完美计算物质崩塌的视觉效果,全程无后期音效合成。
所属事件:用 Minimax H3 制作音画同生短片《在途》(3 条相关)→
「多模态」频道最新
- Runway 生成 15 秒纯黑白片头完整 Prompt — umesh_ai · 2026-09-01
- DreamX-Creator:7B 模型原生生成 2K 音视频 — GD-ML · 2026-09-01
- 如何生成含不同口音的多角色对话视频? — delveccio · 2026-09-01
- 多模态生成技巧:先用 Gemini 起草再用 Sol 修正 — A_K_Nain · 2026-09-01
- 日式体育挑战:30 秒实拍级视频生成 — SimplyAnnisa · 2026-09-01
- Seedance 2.5 升级:提升 AI 虚拟网红视频的一致性与故事性 — aftahi_ai · 2026-09-01