MiniMax 发布全模态生成模型 H3,支持 2K 视频且价格低于主流 1/3

赛博禅心 · wechat · 2026-07-31

MiniMax 正式发布全模态生成模型 H3,支持文本、图像、视频、声音的统一理解与生成,可输出原生双声道音视频,最高支持 15 秒 2K 分辨率。H3 在指令遵循、文字与品牌信息呈现、视频到视频动作迁移(V2V Motion Transfer)等方面表现出色,适用于广告、电商、游戏等商业场景。

技术亮点:

定价:2K 分辨率下每秒价格不到主流模型的 1/3,768P 下不到 1/2。

开源计划:未来几天内开放模型权重,并考虑国产芯片适配。

设计理念:打破任务边界,从专用迈向通用,统一图像、视频、音频生成任务。

所属事件:MiniMax 发布全模态模型 H3:支持 2K 立体声视频即将开源(10 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →