MiniMax发布开源多模态模型H3,打通图音视频生成

PrajwalTomar_ · x · 2026-08-01

MiniMax 发布了全新的通用多模态生成模型 H3。该模型将文本、图像、视频和音频生成整合在单一架构中,能够理解统一的上下文意图,并原生生成带有立体声音效的视频。

评论认为,H3 打破了以往创作工具割裂的局面,减少了不同工具切换带来的上下文损耗。此外,该模型宣布将开放权重,这标志着 AI 视频生成正从单一的片段拼接迈向真正的工业化生产流程。

所属事件:MiniMax发布全模态模型H3:直出2K立体声视频(17 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →