专题 · FULL STORY

MiniMax H3:从早期测试到开源登顶

MiniMax 全模态模型 H3 从早期测试、正式发布到宣布开源,凭借 2K 原生立体声视频生成能力引发热议。随后该模型在评测榜单登顶并上线第三方平台,持续扩展应用生态。

2026-07-30 ~ 2026-07-31 · 5 集 · 84 条

第 1 集 · MiniMax H3视频模型多维度实测效果惊艳(2026-07-30,57 条)

MiniMax(海螺 AI)最新一代视频生成模型 H3 开启早期测试,凭借出色的生成能力与极低的限制引发大量关注。实测表明,该模型在多项指标上达到行业顶尖水平,其实力已被多位开发者认为比肩甚至超越 Seedance 2.0 与 Kling Motion Control 3.0。

已确认

  • 核心规格:H3 模型单次生成视频最长可达 15 秒,原生分辨率最高支持 2560 × 1440(2K)。该模型作为全能模型,支持最多 12 个跨模态参考素材输入(涵盖图像、音频、视频等,单个素材最长 15 秒)。
  • 生成能力:多位创作者实测证实,H3 具备极佳的复杂提示词理解能力,能精准执行包含复杂空间变换的运镜指令(如一镜到底极速穿梭)。模型在物理运动自然度、动作连贯性、文字渲染清晰度以及高保真语音与口型同步方面表现扎实。此外,模型能够将画面的色彩、光影与构图意图融入生成逻辑中,而非机械还原元素。
  • 价格与生态:据测试用户反馈,H3 模型在提供高标准分辨率生成的同时,保持了较低的价格与较少的使用限制,配套的分镜(Storyboard)功能也同步可用。

为什么重要

  • 重塑商业片质感:在同等提示词测试下,多位评测者指出 H3 生成的成片在产品交互动态感、画面过渡流畅度及整体叙事节奏上超越了 Seedance 2.0,质感非常接近高水准商业广告。
  • 创作工作流革新:仅凭少量静态图片(如 5 张参考图或 5 帧静态画面),H3 就能生成连贯的短片或影视片头,并能完美分离视频背景与人物进行替换。这种将多模态参考、高质量直出与极低门槛结合的特性,使其成为极具实用价值的 AI 视频工具。

还有 37 条相关讨论 →

第 2 集 · MiniMax发布全模态模型H3,支持2K原生立体声视频(2026-07-30,15 条)

MiniMax 正式发布全模态生成模型 H3,统一了文本、图像、视频和声音的理解与生成能力。该模型最高可生成 15 秒 2K 分辨率(24fps)的视频,并自带原生双声道音频输出,同时引入了 12 项资产参考功能。目前模型已上线海螺 AI 网页端、MiniMax API、fal 以及 Topview 等平台,并即将以开放权重形式开源,其极具竞争力的定价引发了社区关注。

已确认

  • 多模态与输出规格:H3 支持多模态上下文理解,可直接输出带有原生立体声、最高 15 秒 2K 分辨率(24fps)的视频,具备商业级可用的画面质感。作者 @量子位 指出,该模型打破了传统视频模型仅生成素材的局限,将剪辑逻辑、字体排版、转场设计、背景音乐及视觉特效端到端集成,可直接输出 2K 成片。
  • 12 项资产参考(12-Asset Reference):允许用户组合多达 9 张图片、3 个视频片段和 3 个音频片段作为参考,从而精准锁定角色形象、运动轨迹与音频特征。
  • 商业级能力:在精确文本与品牌信息渲染、视频到视频动作迁移(V2V Motion Transfer)等方面表现出色,主要面向广告和电商等商业场景。
  • 平台与定价:模型已上线 fal、Topview 平台与海螺 AI。据作者 @赛博禅心 透露,其 API 价格低于主流模型的三分之一;作者 @angrypenguinPNG 也指出其成本仅为一小部分,功能可媲美 Seedance。

尚未确认

  • 开源细节与时间:官方及多位创作者确认该模型即将开源,但具体时间表尚未完全敲定。作者 @cocktailpeanut 提到,官方表示将在未来几天内“遵守法律法规”开放权重,部分网友因等待开源进度而吐槽催促直接放上 BitTorrent。

为什么重要

H3 的发布标志着视频生成模型在多模态融合上的进一步成熟。原生立体声音频与高质量 2K 画面的结合,配合精细的多素材参考控制功能,大幅降低了商业视频制作的门槛。同时,其具有竞争力的定价策略以及即将开源的举措,有望在当前的 AI 视频生成市场中快速抢占份额。

第 3 集 · MiniMax H3 模型即将发布并宣布开源(2026-07-30,7 条)

MiniMax 官宣新一代模型 H3 即将发布,并确认模型权重很快将开源发布。早期测试显示,该模型在视频生成和多模态理解方面表现优异,引发了社区的强烈关注与讨论。

已确认

  • 要点 MiniMax 官方在 Hugging Face 平台透露,H3 模型即将推出且权重很快会开源。
  • 要点 官方账号展示了基于 H3 模型在海螺 AI 平台上的实际生成效果,引发社区惊叹。
  • 要点 同步曝光的还有 MiniMax M3 模型的相关信息,展示了其在稀疏注意力和数学证明生成方面的能力。

尚未确认

  • 要点 视频模型规格:据早期体验反馈,H3 视频模型支持原生 2560 × 1440 (2K) 分辨率与长达 15 秒的视频生成,且完全由模型直出无后期剪辑。
  • 要点 原生多模态能力:有开发者测试称,H3 主打原生多模态理解,允许用户自由组合最多 12 个参考素材(支持视频、文本、图像和音频混合搭配)。
  • 要点 生成效果:测试者使用极简提示词便生成了极具电影感的画面,动漫风格动画生成表现惊艳。

为什么重要

  • 要点 如果 H3 能够在 ComfyUI 等本地环境中以 RTX 3060 级别显卡运行,将极大造福算力贫乏的开发者,降低技术门槛。
  • 要点 其强大的多模态混合输入能力,被视为在多模态领域对标行业前沿的重要一步。

第 4 集 · MiniMax-H3开源模型登顶AI视频编辑榜首(2026-07-31,3 条)

MiniMax 最新开源的视频模型 H3 在 Artificial Analysis 评测中表现强劲,与 Google 的 Gemini 并列登顶视频编辑榜单,并在文生视频和图生视频榜单中位列前三。该模型支持多模态输入并能生成带原生音频的内容,其 2K 视频的定价更是低于市场上多数竞品。

第 5 集 · MiniMax H3 视频模型上线 Topview,主打高性价比(2026-07-31,2 条)

MiniMax H3 视频生成模型已正式上线 Topview 平台。该模型支持原生 2K 分辨率与 15 秒视频生成,能够同时理解文本、图像、音频和视频,实现跨模态的创意控制。此外,MiniMax H3 在定价上极具竞争力,其使用成本仅为竞品 Seedance 2.0 的 30%,为用户提供了高性价比的视频生成选择。