MiniMax 发布开源全模态模型 H3,主打原生音视频与极低推理成本

aigclink · x · 2026-08-03

MiniMax 正式发布并开源 H3 模型权重,这是一款通用的全模态生成系统,能够统一理解文本、图像、视频和声音,并直接生成带有原生立体声的视频内容。

核心能力与优势:

局限性说明:H3-Regenerate-2K 模块与稀疏注意力实现暂未开源,部分场景的画面细节精度仍有提升空间。

所属事件:MiniMax 发布开源全模态模型 H3,支持原生 2K 音视频生成(14 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →