MiniMax H3 即将登陆 ComfyUI:原生生成音画同步视频
ZerOne82 · reddit · 2026-08-01
MiniMax 即将开源其全新的多模态模型 MiniMax H3,并有望在一日内登陆 ComfyUI 实现本地部署。
- 核心亮点:该模型能够原生生成带有完美音画同步的视频,一举解决 AI 视频生成中长期存在的配音对齐痛点。
- 综合能力:据称 H3 在叙事连贯性、镜头切换、提示词遵循、画面一致性以及长视频生成等方面均有卓越表现。
- 实测样片:作者分享了多个展示视频,包括自然说话与性格匹配、电影级运镜与变形、音乐 MV 以及混合风格生成,展现了模型在视听一体化创作上的潜力。
「多模态」频道最新
- 一人徒手打造 46 分钟 AI 科幻长片,分享图生视频工作流 — ABePick · 2026-08-01
- 多模态智能体内容生成演进:从文本到语音、视频乃至 VR — nptacek · 2026-08-01
- Seedance 视频模型登陆 LoovaAI,实测画面更具电影感 — socialwithaayan · 2026-08-01
- Midjourney v8.2 爆「数字衰变」特效,提示词引出离谱图像 — michaelrabone · 2026-08-01
- 德国法院裁定 AI 音乐生成器 Suno 侵犯版权 — The Decoder · 2026-08-01
- Krea2 专属高清放大 LoRA 发布,最高至 1024p — Suspicious_Aide2697 · 2026-08-01