MiniMax H3 实测:图+音生成视频口型同步惊艳
multimodalart · x · 2026-08-18
开发者分享了利用 MiniMax H3 模型进行“图+音生视频”的测试结果。通过向 H3 输入图片和外部音频而非自动生成音频,生成的视频在口型同步和面部动作自然度上表现出色。作者已将该流程基于 Diffusers 实现 I2V 版本并提供了 Demo 链接。
所属事件:MiniMax H3 实测:图+音生视频口型同步惊艳(5 条相关)→
「多模态」频道最新
- 16GB 显存本地跑通 LTX 2.5 生成完整 MV,效果出乎意料 — sokmech · 2026-10-02
- Eleven v4 角色动画演示:音频驱动角色口型与表演 — buraktuyan · 2026-10-02
- 让 Claude 当导演:Fable 5.1 自主产出一支超现实主义 AI MV — cheetoskull · 2026-10-02
- Krea 2 Turbo 一体化 ComfyUI 工作流:2/4 步 LoRA 提速出图 — TimeTruth2490 · 2026-10-02
- 全队没人会用 Blender,靠 Claude 跑通整套 3D 电影工作流 — gen_ericai · 2026-10-02
- Meshy 预告 3D 局部编辑:选中区域输入文字即可改 — rms80 · 2026-10-02