MiniMax H3开源视频模型上线ComfyUI,支持15秒768p生成
pmttyji · reddit · 2026-08-10
MiniMax H3 是一个开源的多模态视频生成模型,支持文本、图像、视频和音频。在 ComfyUI 中,可用于文生视频、图生视频、首尾帧生成和参考驱动创作。H3 能联合生成视觉和同步立体声(包括对话、音效、环境音和音乐),而非后期添加音频。开源权重支持最长15秒、768p的片段;托管版本支持高达2K分辨率。文章还讨论了H3如何将多种生成任务统一到一个架构,其高压缩视频表示如何提高效率,以及开发者本地部署的注意事项。
「多模态」频道最新
- AI 生成 3D 世界初现雏形,未来有望逼近 GTA 级开放世界 — Scobleizer · 2026-08-10
- KVAE多模态分词器:全面超越现有图视频音频开源VAE — NielsRogge · 2026-08-10
- 开源本地RAG工具:将艺术史转为结构化提示词 — lololerigolo60 · 2026-08-10
- Tripo P2 实测:AI 终于能生成完美低模,拓扑与模型分段大突破 — nicolascraske · 2026-08-10
- 12GB显存跑Minimax H3:低显存视频生成加速实操 — Support_Marmoset · 2026-08-10
- 单句提示词生成怪兽咆哮大片,AI视频颠覆传统特效 — heypearlai · 2026-08-10