专题 · FULL STORY

MiniMax H3:从实测刷屏到生态爆发

MiniMax H3 视频生成模型发布后引发社区密集实测,消费级显卡即可跑出高一致性动画短片,口型同步与文生图能力惊艳。三周内 ComfyUI 生态迅速跟进,从提速工作流、开源插件到一键部署包相继问世,围绕该模型的工具链与画质增强方案持续完善。

2026-08-04 ~ 2026-08-25 · 13 集 · 64 条

第 1 集 · ComfyUI新工作流让MiniMax视频生成提速12倍(2026-08-04,3 条)

开发者分享了针对 MiniMax H3 视频生成模型的优化工作流,通过“低分辨率生成+放大”策略大幅提升渲染效率。具体而言,先生成 480p 视频再利用 FlashVSR 等节点进行 2 倍放大,不仅使生成速度提升约 12 倍,且最终画质接近原生 1080p 水平。Reddit 用户实测也证实,借助特定节点加速后,高分辨率与低分辨率渲染效果几乎无差,该方案有效颠覆了现有的视频生成工作流。

第 2 集 · 开发者实测MiniMax H3模型结合ComfyUI生成MV(2026-08-05,2 条)

近日有开发者分享了使用MiniMax H3模型快速生成音乐视频的实测案例。该工作流通过开源的ComfyUI Video Builder接入H3模型,并配合Suno生成的音乐,实现了一键快速构建MV,展示了该模型在视频生成领域的实际应用潜力。

第 3 集 · MiniMax H3 结合 LTX 模型实现低显存视频高清化(2026-08-07,3 条)

近期,开发者社区分享了将 MiniMax H3 视频生成模型与 LTX 2.3 放大技术相结合的工作流。该方案通过 ComfyUI 标准模板生成视频,并利用 LTX 模型进行画质修正与分辨率提升。这套工作流尤其适合低显存环境,能够在不大幅改变原视频画面的前提下,有效清理低分辨率渲染噪点,实现视频的高清化。

第 4 集 · 开源ComfyUI-H3Studio:单节点生成长视频(2026-08-12,2 条)

拥有15年视频编辑经验的开发者推出了开源插件ComfyUI-H3Studio。该工具专为ComfyUI环境设计,主打通过单一节点即可实现长视频的创建工作流,大幅简化了用户的操作过程。此外,该插件还附赠了MiniMax LoRA训练器,并提供了清晰的使用说明与基础工作流,进一步降低了视频创作的技术门槛。

第 5 集 · ComfyUI 新增 MiniMax H3 任意帧图像与音频引导(2026-08-14,2 条)

ComfyUI 近期合并了 PR #15439,为视频生成模型 MiniMax H3 引入了全新的引导功能。此次更新允许用户在视频的任意指定帧锚定图像,并添加音频引导。该功能不仅附带了演示视频,还提供了相应的示例工作流,大幅提升了视频生成的可控性与创作自由度。

第 6 集 · MiniMax H3 Creator 新增预设功能与多项更新(2026-08-14,4 条)

MiniMax H3 Creator 的 ComfyUI 节点迎来多项更新,新增预设功能允许保存并复用设置,甚至从 MP4 文件中提取工作流。此外,更新还涉及原生设置面板、无限输入、音频同步以及面部修复等工具的优化。

第 7 集 · MiniMax H3 实测刷屏:一致性突破,动画短剧一次成片(2026-08-15,24 条)

MiniMax H3 视频生成模型因其出色的生成能力和控制力引发社区密集实测。创作者们利用该模型在 RTX 5090、4070 Ti Super 等消费级显卡上完成了 6 分钟动画、音乐视频及 1 分 12 秒短剧。测试表明,H3 在原生音画同步、多镜头角色一致性及多模态参考控制方面表现优异,目前主要短板在于超过 15 秒的长视频一致性较难保持。

已确认

  • 原生音效与多模态控制:@thetripathi58 指出生成的 2K 视频自带精准匹配的音效(如雨声、雷声),无需后期合成;单次 Prompt 可组合 9 张图片、3 个视频和 3 个音频参考,在 15 秒内能维持运镜与动作高度一致。
  • 长片与硬件探索:@Electrical-Speed2409 使用 RTX 5080 16GB 配合 SageAttention,以 10 步、0.6 百万像素分辨率逐段生成,完成了 1 分 12 秒的 TikTok 短剧;@dassiyu 使用 RTX 5090 配合本地 Gemma4 31B,实现了 6 分钟生成 6 分钟动画。
  • 性能与工作流:@gokuchiku 在 RTX 5070Ti + 32GB DDR5 上以 T2VA 原生 1MP 分辨率生成,耗时约 23 分钟;@ExportErrorMusic 使用 ComfyUI 默认工作流、Comfy Kitchen 与 Kijai 预览覆盖,配合 850k turbo LoRA 制作音乐视频。
  • 风格与场景表现:@ajrss2009 在同一场景混搭真人《生活大爆炸》与 2D《海绵宝宝》;@JellyfishFluffy4190 称巨型奇幻场景尺度感出色、无比例崩坏;另有用户展示了《Manifest》剧集风格复刻及人脸修补效果。
  • 一致性短板:用户 zast57 测称 720p 出片效果惊艳,但使用“继续上一个视频”制作超 15 秒长片时前后一致性仍难保持。

尚未确认

  • @teortaxesTex 转述多位评测者称 H3 基于 33B 参数、堪比“Sora 升级版”,参数规模未见官方证实。

为什么重要

  • H3 在一致性、原生音画同步与多模态控制上的实测表现,使其成为当前开源视频生成领域的有力竞争者。
  • 模型对消费级显卡的友好支持及成熟的 ComfyUI 工作流,大幅降低了独立创作者制作高质量视频的门槛。

还有 4 条相关讨论 →

第 8 集 · MiniMax H3 迎来 ComfyUI 生态爆发(2026-08-15,10 条)

MiniMax H3 视频模型在三天内密集落地 ComfyUI 生态,从一键部署包到长视频管理工具相继问世。cocktailpeanut 发布了开箱即用的一键环境胶囊,AxonkaiLab 确认 H3 已可在 ComfyUI 中完全本地部署与运行。同时,社区开发者相继开源长视频分段、断点续跑及参考图管理等自定义节点,共同解决了本地部署繁琐、长视频需反复搭建工作流、参考图连线复杂三大痛点,本地工作流生态迅速成型。

已确认

  • cocktailpeanut 发布 MiniMax H3 专用 ComfyUI 一键环境胶囊,内置文生视频、图生视频、参考生视频及提示词增强工作流,环境完全隔离、开箱即用。
  • 长视频方向至少有三款节点:AwayExam4586 的 MiniMax H3 Extender 支持逐段或全批量生成,内置 Motion Context 上下文传递与自动拼接;IllProfile8808 的节点支持连续传递视听潜在状态,中断后可从失败片段恢复;Acceptable-Chest9695 的 MiniMax H3 Motion Director 整合了 AIMixer、Motion Context 等功能,主打多片段连贯性。
  • Hearmeman98 发布参考图管理节点,一次连线即可添加或移除最多 18 个参考图输入,集成 OpenRouter 自动生成结构化提示词。
  • UsefulAd52 转介开发者 LeonQ8 的 ComfyUI-ALLinONE 节点,集成多种 H3 工作流,帮助用户避开复杂流程与易错环节。
  • MEOW 第 47 期演示并确认 H3 可在 ComfyUI 中完全本地部署与运行。

时间线

  • 08-15:cocktailpeanut 一键整合包、H3 Extender、Hearmeman98 参考图管理节点发布
  • 08-16:ALLinONE 节点、可恢复多镜头节点、Motion Director 相继开源
  • 08-17:MEOW 第 47 期报道并演示 H3 完全本地部署

为什么重要

  • 长视频连贯性、上下文状态传递与断点续跑是视频生成模型工程化落地的核心难题,三天内出现多个互相独立的开源方案,且解法趋同,显示社区需求强烈。
  • 一键整合包大幅降低非专业用户门槛,分工细化的节点则让 H3 更易嵌入现有 ComfyUI 生产线,本地化路径成型后用户对官方/API 端的依赖有望减弱。

第 9 集 · MiniMax H3 实现 15 秒对口型 MV 唇形同步完美(2026-08-15,2 条)

用户使用 MiniMax H3 成功制作 15 秒音乐视频,音频解析出色,唇形同步表现完美。工作流利用参考功能构建对口型效果,通过参考图生成角色与环境,展示了模型在音频与视觉匹配上的能力。

第 10 集 · MiniMax H3 本地 2K 放大工作流登陆 ComfyUI(2026-08-15,3 条)

创作者为 MiniMax H3 打磨 ComfyUI 放大工作流:对比 dual-sampler 与 LTX 2.5 方案后,发布 Ultimate SD Upscale Guider 节点补齐原生支持,最终实现本地真 2K 放大,相关资源已在 GitHub 开源下载。

第 11 集 · MiniMax H3文生图实测精准惊人发布工作流(2026-08-17,2 条)

Reddit用户实测发现,尽管MiniMax H3并非作为专用图像模型发布,但其文生图指令遵循能力表现惊人,尤其在艺术风格还原上优于GPT Image。社区已发布基于H3构建的ComfyUI工作流,专注于利用其强大的指令跟随能力进行图像生成。

第 12 集 · MiniMax H3 实测:图+音生视频口型同步惊艳(2026-08-17,5 条)

多位用户与开发者对 MiniMax H3 视频生成模型进行了实测,整体反馈积极,其中「图+音频生成视频」的口型同步能力最受关注。

已确认

  • 开发者 multimodalart 测试了 MiniMax H3 输入图片与外部音频(而非模型自动生成音频)生成视频的流程,实测口型同步与动作自然度表现惊艳;他已将该功能基于 Diffusers 实现为 i2v 版本并发布了 Demo(m5 为同一信息的重复转述)。
  • linoytsaban 同样实测了「音频+图片生成视频」,认为口型同步和整体质量出色,实现基于 🧨diffusers 库,并建议尝试复杂场景。
  • 用户 rmrfallfiles 的第二次测试采用 32 步以上参数,生成效果较好;首次测试为 0.3MP 低分辨率预览,快速运动场景出现变形问题。
  • 用户 BeginningTip300 用 MiniMax H3 在本地 5060ti 显卡上以 0.3MP 分辨率生成了一段风格荒诞的动漫广告短片,旁白配音使用 Grok Imagine。

为什么重要

  • 图+音生视频且口型同步良好,结合 Diffusers 生态的开源实现,意味着该能力可被开发者便捷复用与二次开发,降低数字人、配音视频等应用的门槛。
  • 消费级显卡(如 5060ti)即可本地运行,显示模型对算力要求相对友好;但低分辨率与快速运动下的变形问题提示实际应用需权衡参数设置。

第 13 集 · 社区探索 MiniMax H3 视频画质增强工作流(2026-08-24,2 条)

社区围绕 MiniMax H3 生成视频的画质提升展开讨论:有用户分享先用 MiniMax H3 生成 1504x832px 初始画面,再通过 Ultimate SD Upscale 放大修复低分辨率结果的工作流;也有用户发现 H3 生成画面在细节处存在卡顿,希望获得添加增强工作流的操作指引以改善画质。