MiniMax 发布 H3 视频模型:支持 2K 原生立体声,即将开源

JGByvygyrfg · reddit · 2026-07-31

MiniMax 推出通用多模态生成模型 H3,支持文本、图像、音频和视频的统一上下文理解。该模型能生成最长 15 秒、2K 分辨率且带原生立体声的视频,在指令遵循、文本与品牌渲染及 V2V 运动迁移方面表现出色,主要面向广告、电商和游戏等商业内容创作。

在定价方面,H3 默认提供 2K 分辨率输出,其每秒价格不到主流模型同分辨率的三分之一;在 768p 分辨率下,价格也低于主流模型 720p 的一半。此外,为支持开源生态与更广泛的硬件兼容,MiniMax 计划在未来几天内开放 H3 的模型权重。

所属事件:MiniMax 发布全模态模型 H3:支持 2K 立体声视频即将开源(10 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →