MiniMax开源视频模型H3:330亿参数统一多模态,登顶HF热度榜

大模型之路 · wechat · 2026-08-13

MiniMax于8月3日开源视频生成模型H3,权重上线HuggingFace和魔搭社区,三天内登顶HF热度榜,超百家企业首日接入。H3采用330亿参数的稠密单流Transformer(H3-Omni-Transformer),统一理解生成文字、图片、视频、音频,支持最长15秒、2K分辨率、24帧视频,原生32kHz立体声,六种画幅和11种语言。开源两个checkpoint:FL2VA(文生视频、首帧/尾帧/首尾帧生视频)和Ref2VA(全模态参考,最多9图3视频3音频)。技术上通过ContextualOmniRepresentation机制将上百K token素材压缩至约4K token描述。在DesignArena上多图生视频、图生视频、视频编辑均获开源第一;ArtificialAnalysis视频编辑Elo 1127分全球第一,文生视频含音频1237分仅次于Gemini Omni Flash。价格约0.8元/秒,为闭源旗舰三分之一。但H3-Regenerate-2K模块未开源,许可证有地区限制。发布后MiniMax股价一周涨78%,纳入港股通。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →