MiniMax 发布开源视频模型 H3:直出 2K 成片,登顶编辑榜单

量子位 · wechat · 2026-07-31

MiniMax 正式发布全新一代视频模型 MiniMax H3,并宣布首个开源。该模型打破了传统视频模型仅生成素材的局限,将剪辑逻辑、字体排版、转场设计、背景音乐及视觉特效端到端集成,支持全模态输入,可直接输出 2K 分辨率的成片。

在实测中,H3 展现出极强的意图理解与多模态协同能力:不仅能精准生成手绘特效与动态片头,还大幅改善了 AI 视频的文字渲染难题,能保证文字在动态帧中的形态稳定与光影融合。此外,模型支持音频输入以生成情绪匹配的台词。

价格方面,H3 的 API 定价极具优势,2K 分辨率下每秒价格不到主流模型的 1/3。底层技术上,团队搭建了 H3-OmniTransformer 原生架构,通过定制 Caption 模型与全模态理解管线,实现了多模态与语言的深度涌现。开源策略使其成为榜单第一且唯一开放权重的视频模型,为企业私有化部署与定制化微调提供了可能。

所属事件:MiniMax 发布全模态模型 H3:直出 2K 视频,即将开源(14 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →