MiniMax H3 支持图+音生视频,实测口型同步效果惊艳
multimodalart · x · 2026-08-18
开发者测试了 MiniMax H3 模型的图像与音频生成视频能力,通过输入图片和音频而非让模型自动生成音频。实测结果显示,该流程在口型同步和动作自然度方面表现惊人。作者已将该功能集成到 Diffusers 的 i2v 版本中并发布了 Demo。
所属事件:MiniMax H3 实测:图+音生视频口型同步惊艳(5 条相关)→
「多模态」频道最新
- 16GB 显存本地跑通 LTX 2.5 生成完整 MV,效果出乎意料 — sokmech · 2026-10-02
- Eleven v4 角色动画演示:音频驱动角色口型与表演 — buraktuyan · 2026-10-02
- 让 Claude 当导演:Fable 5.1 自主产出一支超现实主义 AI MV — cheetoskull · 2026-10-02
- Krea 2 Turbo 一体化 ComfyUI 工作流:2/4 步 LoRA 提速出图 — TimeTruth2490 · 2026-10-02
- 全队没人会用 Blender,靠 Claude 跑通整套 3D 电影工作流 — gen_ericai · 2026-10-02
- Meshy 预告 3D 局部编辑:选中区域输入文字即可改 — rms80 · 2026-10-02