MiniMax 发布 H3 全模态模型:支持 2K 视频与原生立体声生成
multimodalart · x · 2026-08-03
MiniMax 在 Hugging Face 上发布了全新的 H3 全模态生成系统。该模型支持文本、图像、视频和音频的统一理解,并能生成带有原生立体声的视频。
核心特性:
- 高规格输出:支持生成最长 15 秒、最高 2K 分辨率、24 FPS 的视频,音频采样率为 32kHz 立体声。
- 多模态输入:支持文生视频、图生视频、参考视频生成以及首尾帧生成等多种模式。
- 多语言支持:稳定支持中、英、日、法等 11 种语言的指令交互。
- 消费级部署:模型参数量达 33B,但已原生适配 🧨 Diffusers 和 ComfyUI,可在消费级 GPU 上运行。
所属事件:MiniMax-H3 模型卡曝光:支持图生视频与原生立体声(9 条相关)→
「模型」频道最新
- MiniMax 官宣 H3 视频生成模型,支持图生视频与音频 — MiniMaxAI · 2026-08-03
- 网友喊话通义千问:期待推出200B参数开源模型 — adrianscottcom · 2026-08-03
- Code Arena榜单:Claude Opus 5 Max登顶Web开发评测 — arena · 2026-08-03
- Qwen3.8-Max 定价曝光:比 Kimi K3 便宜近三倍 — cedric_chee · 2026-08-03
- Anthropic Opus 被批体验拉胯:过度讨好且常偏离指令 — yacineMTB · 2026-08-03
- Qwen3.8-27B即将开源,17GB内存即可本地运行 — danielhanchen · 2026-08-03