MiniMax 发布开源全模态模型 H3,支持原生 2K 立体声视频

MiniMax 正式发布并开源了通用全模态生成系统 MiniMax-H3。该模型参数量为 33B,能够统一理解文本、图像、视频和音频的多模态上下文,并支持文生视频、图生视频、参考图生成视频等多种输入方式,甚至允许用户在一次生成中同时启用视频、图像、文本与音频作为参考素材。在输出方面,H3 能够端到端生成最高 2K 分辨率、最长 15 秒且带有原生立体声的视频,而非后期配音。

已确认

为什么重要

2026-08-02 ~ 2026-08-03 · 13 条相关

事件全程(共 14 集)→

一手来源

另有 7 条近重复转述:multimodalart · VoidAsuka · MiniMax 稀宇科技 · 赛博禅心 · jiqizhixin · MiniMaxAI · aigclink