专题 · FULL STORY

MiniMax H3实测走红并登顶竞技场

MiniMax H3上线后掀起全球创作者实测潮,角色一致性与多风格长视频生成广受好评,Reddit与X上demo密集刷屏;随后该模型凭2.5万余次社区盲测投票登顶AI视频编辑竞技场榜单。

2026-08-07 ~ 2026-08-15 · 4 集 · 48 条

第 1 集 · MiniMax H3实测:角色一致与续写工作流获赞(2026-08-07,13 条)

近期多位创作者实测了 MiniMax H3 视频生成模型,围绕角色一致性、视频续写和文本转视频等场景探索出多种高效工作流。该模型在保持连贯动作和高质量画面方面的表现获得了积极评价,多位创作者称其效果“如同魔法一般”,被认为是目前制作短片的有效工具。

已确认

  • 角色一致性与连贯动作:@BigDovahkiin 分享了使用 Krea 生成角色设定图,再利用 MiniMax 参考图模式保持角色一致性的工作流,成功生成了赛博朋克风格的连贯打斗短片。他表示这是第一个让他没有感到无聊的视频模型。
  • 视频续写工作流:@Exile3D 探讨了使用 H3 模型延长或续写视频片段的有效方法。他认为最佳流程是结合多个角色参考图和配音,将视频的最后一帧作为参考加载,以此为基础让模型继续生成并保持角色一致性。
  • 文本转视频能力:@andrewh2000 实测将小说《Dungeon Crawler Carl》的文本内容直接输入模型,成功转化为了高质量的电影级视频片段。
  • 参考图使用技巧:@GlitteringTie3110 测试了利用参考图提升角色一致性并尝试跨作品角色融合。实验发现,保持参考图的宽高比与目标视频一致,并严格遵循官方提示词编写指南,能显著提升生成质量。
  • 自动化工作流:@jacobpederson 展示了使用 Krea 和 Minimax H3 模型构建的自动化视频生成工作流(Reimagine Script v3.0)。
  • 音视频对话拼接:@niechta 将 AI 视作“笨拙的摄影师”,通过分别生成独立镜头、覆盖画面和无声反应片段,手动剪辑拼接出一段 2 分钟的对话场景。
  • T2V 结合首帧生成:@reynadsaltynuts 采用先生成文本到视频(T2V),再结合首帧生成视频(1st Frame2V)的工作流制作动画。
  • 视频角色替换:@beatlepol 实测了视频角色替换功能,成功将原视频中的巨型猫咪替换为狗狗,并保持了原有的场景设定和动画轨迹。
  • 复杂场景与图生视频:@uhf789 分享了图生视频(Image-to-Video)的实测演示;@Disastrous-Agency675 生成了名为“Between heaven and hell”(天堂与地狱之间)的视频,展示了复杂场景与氛围渲染能力;@egeberkina 转发了由 H3 生成的片段,调侃其呈现出如同被删减的情景喜剧般的意外效果。

为什么重要

这些实测案例展示了 MiniMax H3 在实际创作中的潜力。通过结合外部工具(如 Krea)和特定的提示词技巧,创作者已经能够解决视频生成中长期存在的角色一致性和动作连贯性痛点,使其具备了制作高质量叙事短片和跨媒介内容改编的实用价值。

第 2 集 · MiniMax H3海外实测:多风格长视频生成获好评(2026-08-12,13 条)

8月12日至14日,MiniMax H3视频生成模型在海外社区引发集中实测,十余名用户晒出图生视频、动漫复刻、写实手持、海报动画等多样demo。普遍反馈是输出质量高、生成过程成瘾性强;Motion Context双片段链接与参考图引导被视为解决多镜头连贯、角色一致性问题的有效手段。有用户还晒出RTX Pro 6000 Blackwell本地硬件配置,显示该模型可在本地运行。

已确认

  • @GamerVick 使用双片段链接(two chained clips)加 Motion Context 功能生成 30 秒连贯短故事,验证多镜头叙事能力(m1 与 m9 为同一演示,仅计一次)。
  • @OohFekm 仅用一张图片加一句提示词(蝙蝠侠跑向海边观察怪物并用热视线射击),配合应用内 LLM 增强提示词完成图生视频,效果极佳。
  • @JahJedi 基于 ref2av 工作流,以两张角色参考图和一张学校场景照片引导生成,参数为 1.5 百万像素、30 步,并启用了 sage…(帖文截断)。
  • @nothashira 复刻《龙珠》2D 动漫风格并创作同人角色,展示了特定动漫风渲染与动作连贯性。
  • @b-totherent 将 H3 与 LTX 2.5 结合,生成自然光影、拟真动作的手持写实画面。
  • @JustARedditUser33 生成《浴血黑帮》主题混剪,呈现复古电影质感,同时体现模型对现代敏感度审查的处理表现。
  • @princeMacX 生成蝙蝠侠与小丑屋顶打斗、俱乐部打扑克两个场景,测试复杂动作与叙事。
  • @LudovicCreator 将静态海报动画化并尝试 16:9 比例,认为这为动画创作打开更多可能。
  • @dhavalhirdhav 生成 30 秒巨龙视频,展示长视频生成与复杂生物动态控制的潜力。
  • @moohlit 称生成极具成瘾性、几乎每次输出都令人惊艳,并附 RTX Pro 6000 Blackwell 本地配置(模型标注 L2VA);@esudious 表示玩得很开心。

尚未确认

  • 本地运行的具体部署细节(如显存占用、推理速度)未在帖中提供,本地可用性仍待更多信源确认。

为什么重要

  • Motion Context 与参考图引导(ref2av)直指 AI 视频的两大痛点——多镜头连贯与角色/场景一致性,社区实测初步验证有效。
  • 风格覆盖面广:2D 动漫、复古电影、写实手持、海报动画均有正面反馈,且出现多个 30 秒长片段案例。
  • 有用户在本地高端显卡上运行并给出配置信息,但帖文未提供完整部署细节,本地可用性仍待更多信源确认。

第 3 集 · MiniMax H3实测:视频生成与编辑能力获社区广泛好评(2026-08-13,20 条)

MiniMax H3 视频生成模型在 Reddit 和 X 上引发密集实测潮。多位创作者展示了其生成的城堡场景、恶搞广告、音乐视频、情景喜剧等多样内容,并验证了参考视频+提示词的编辑工作流、唇形同步、背景替换等能力。多数反馈积极,认为效果惊艳,但本地生成速度仍受算力限制,有用户实测 RTX 3090 生成 10 秒视频需约 15.5 分钟。

已确认

  • 多位用户(beatlepol、pooshda、JustSecond9861 等)展示了 H3 生成的各类视频,包括城堡场景、恶搞广告、漫画风格动画、音乐视频等,效果获好评。
  • 唇形同步能力突出:Kyrannio、stonyleinchen、michel-yph-ai 等实测音乐视频对口型精准,其中 stonyleinchen 介绍了逐 token 噪声掩码技术。
  • 视频编辑工作流有效:socialwithaayan 和 illumination25 展示了使用参考视频/图片加提示词进行复杂编辑,illumination25 仅用 2 张照片成功替换 12 秒武打视频背景。
  • 本地部署可行但速度慢:danielcar 在 AMD Strix Halo 上生成 5 秒视频需 9.5 分钟;EvolvingSoftware 在 RTX 3090 上生成 10 秒视频约 15.5 分钟;dtdisapointingresult 推算 RTX 5080 生成 8 秒 540p 需 15 分钟,B200 约 1 分钟。
  • 加速方案:michel-yph-ai 使用 8 步 Turbo LoRA、Spectrum 和 Triton 在 L40 上加速;danielcar 使用 int8 剪枝和 4 步 turbo LoRA。

尚未确认

  • 部分用户(如 Kyrannio)计划发布完整演示和评测,但尚未发布。
  • 关于模型的具体版本、参数细节及官方信息未在帖子中提及。

为什么重要

MiniMax H3 展示了 AI 视频生成在创意表达和实用编辑上的潜力,尤其是唇形同步和参考视频编辑能力,可能推动音乐视频、影视后期等应用。同时,本地部署的算力瓶颈凸显,提示了硬件需求与生成效率之间的平衡问题。

第 4 集 · MiniMax H3登顶AI视频编辑竞技场榜单(2026-08-13,2 条)

知名大模型竞技场发布了最新的 AI 视频编辑排行榜。本期榜单基于超 2.5 万次社区投票,对 8 款主流模型进行了盲测评估。结果显示,MiniMax 发布的 H3 视频编辑模型成功拿下第一名。官方称该模型不仅在开源领域处于领先地位,更达成了整体 SOTA(当前最佳)水平,字节 Seedance 紧随其后。