MiniMax 发布开源视频模型 H3:直出 2K 成片,登顶编辑榜单
量子位 · wechat · 2026-07-31
MiniMax 正式发布全新一代视频模型 MiniMax H3,并宣布首个开源。该模型打破了传统视频模型仅生成素材的局限,将剪辑逻辑、字体排版、转场设计、背景音乐及视觉特效端到端集成,支持全模态输入,可直接输出 2K 分辨率的成片。
在实测中,H3 展现出极强的意图理解与多模态协同能力:不仅能精准生成手绘特效与动态片头,还大幅改善了 AI 视频的文字渲染难题,能保证文字在动态帧中的形态稳定与光影融合。此外,模型支持音频输入以生成情绪匹配的台词。
价格方面,H3 的 API 定价极具优势,2K 分辨率下每秒价格不到主流模型的 1/3。底层技术上,团队搭建了 H3-OmniTransformer 原生架构,通过定制 Caption 模型与全模态理解管线,实现了多模态与语言的深度涌现。开源策略使其成为榜单第一且唯一开放权重的视频模型,为企业私有化部署与定制化微调提供了可能。
所属事件:MiniMax 发布全模态模型 H3:直出 2K 视频,即将开源(14 条相关)→
「模型」频道最新
- 曝 Gemini V4-Flash 知识截止日期或晚于 2025 年 5 月 — teortaxesTex · 2026-07-31
- DeepSeek-V4-Flash正式版实测:速度极速,效果竟超 Pro — vista8 · 2026-07-31
- 研究对比:Late Interaction 模型在多语言任务泛化更优 — lateinteraction · 2026-07-31
- 辟谣:OpenAI 官方未提 GPT-5.6 免费向科学家开放 — emmanuelvivier · 2026-07-31
- Anthropic 发布 Claude Opus 5:编码能力登顶,价格仅为旗舰款一半 — emmanuelvivier · 2026-07-31
- Karpathy挑战主流:小模型+工具+闭环反馈才是智能体能力关键 — Div_pradeep · 2026-07-31