MiniMax 发布开源全模态模型 H3,主打原生音视频与极低推理成本
aigclink · x · 2026-08-03
MiniMax 正式发布并开源 H3 模型权重,这是一款通用的全模态生成系统,能够统一理解文本、图像、视频和声音,并直接生成带有原生立体声的视频内容。
核心能力与优势:
- 多模态统一:支持最高 2K 分辨率、15 秒的视频生成,自带原生双声道音频。支持图生视频、视频转视频(V2V)动作迁移,以及音频到音频的参考编辑。
- 极致性价比:官方称其 2K 分辨率下每秒生成价格不到主流模型的三分之一,768P 价格仅为同行 720P 的一半。
- 技术创新:采用 H3-VAE tokenizer(序列长度效率提升 4 倍)、H3-Omni Transformer 统一架构以及异构算力优化(训练吞吐提升约 30%)。训练数据完全由真实自然数据构成。
局限性说明:H3-Regenerate-2K 模块与稀疏注意力实现暂未开源,部分场景的画面细节精度仍有提升空间。
所属事件:MiniMax 发布开源全模态模型 H3,支持原生 2K 音视频生成(14 条相关)→
「模型」频道最新
- 单 CPU 8GB 内存跑 2.78 万亿参数 Kimi K3 — Saboo_Shubham_ · 2026-08-03
- MiniMax-H3 开源权重限制美英欧盟等地访问 — tokenbender · 2026-08-03
- 生物科技从业者呼吁多用 DeepSeek 与 Qwen:查中文技术信息更好用 — MWCvitkovic · 2026-08-03
- tinygrad 预告本地部署新品,暗示 Qwen3.6-27B 即将发布 — max_paperclips · 2026-08-03
- 美国已非开源模型安全区?MiniMax 闭源引发行业担忧 — cocktailpeanut · 2026-08-03
- 传 Qwen3-Max 将开源,2.4T 参数比肩 Sonnet 且价格极低 — bindureddy · 2026-08-03