MiniMax 开源全模态视频模型 H3:支持原生立体声与 2K 画质

MiniMax 稀宇科技 · wechat · 2026-08-03

MiniMax 正式开源新一代通用视频模型 MiniMax-H3。该模型是一个全模态生成系统,能够统一理解文本、图像、视频和音频构成的多模态上下文,并生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。

核心架构与功能亮点:

部署与开源情况:

目前 H3-Base 的模型权重已完全开放,支持 SGLang、vLLM、diffusers 和 ComfyUI 等主流框架进行本地部署。Context-IR 与 2K 重生成模块暂未开源,但官方提供了 API 和完整的端到端工作流供开发者验证与复现。

所属事件:MiniMax 发布开源全模态模型 H3,支持原生 2K 音视频生成(14 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →