MiniMax 发布全模态模型 H3:支持 2K 原生立体声视频
MiniMax 正式发布全模态生成模型 H3,该模型统一了文本、图像、视频和声音的理解与生成能力。H3 最高可生成 15 秒 2K 分辨率的视频,并自带原生双声道音频输出,目前已上线 fal 平台,API 价格低于主流模型的三分之一,且即将以开放权重形式开源。
已确认
- 多模态与输出规格:H3 支持多模态上下文理解,可直接输出带有原生立体声、最高 15 秒 2K 分辨率的视频,具备商业级可用的画面质感。
- 12 项资产参考(12-Asset Reference):允许用户组合多达 9 张图片、3 个视频片段和 3 个音频片段作为参考,从而精准锁定角色形象、运动轨迹与音频特征。
- 商业级能力:在精确文本与品牌信息渲染、视频到视频动作迁移(V2V Motion Transfer)等方面表现出色,主要面向广告和电商等商业场景。
- 平台、定价与开源:模型已上线 fal 平台。据作者 @赛博禅心 透露,其 API 价格低于主流模型的三分之一;此外,Krea 官方及多位创作者确认该模型即将开源。
为什么重要
H3 的发布标志着视频生成模型在多模态融合上的进一步成熟。原生立体声音频与高质量 2K 画面的结合,配合精细的多素材参考控制功能,大幅降低了商业视频制作的门槛。同时,其具有竞争力的定价策略以及即将开源的举措,有望在当前的 AI 视频生成市场中快速抢占份额。
2026-07-30 ~ 2026-07-31 · 9 条相关
- 第 1 集:MiniMax H3 视频生成模型实测效果惊艳(2026-07-30,46 条)
- 第 2 集:MiniMax 发布全模态模型 H3:支持 2K 原生立体声视频(2026-07-30,9 条)
- 第 3 集:MiniMax H3 视频模型早期测试曝光(2026-07-30,4 条)
一手来源
- MiniMax 发布全模态模型 H3:支持原生双声道与 2K 视频 — MiniMax 稀宇科技 ·
- MiniMax 发布全模态生成模型 H3,支持 2K 视频且价格低于主流 1/3 — 赛博禅心 ·
- 对标 Seedance 且成本更低,MiniMax H3 即将开源 — angrypenguinPNG ·
- MiniMax H3 模型回归:支持 2K 分辨率与 12 项参考控制 — Eric520CC · 2026-07-30
- 【源头】MiniMax 发布全模态模型 H3:支持原生双声道与 2K 视频 — MiniMax 稀宇科技 · 2026-07-31
- MiniMax H3视频模型上线fal,支持原生立体声 — DavidmComfort · 2026-07-31
- MiniMax 发布 H3 视频模型,原生 2K 音频即将开源 — Hoodfu · 2026-07-31
- 【源头】对标 Seedance 且成本更低,MiniMax H3 即将开源 — angrypenguinPNG · 2026-07-31
- MiniMax 发布 H3 模型:主打全能参考与商用级生成 — rudrank · 2026-07-31
- MiniMax 发布多模态模型 H3,网友吐槽开源进度催促上 BitTorrent — cocktailpeanut · 2026-07-31
另有 2 条近重复转述:赛博禅心 · JGByvygyrfg