MiniMax H3 全能多模态模型登陆 Hugging Face,原生支持 2K 音视频

jiqizhixin · x · 2026-08-03

MiniMax 官方在 Hugging Face 上发布了全新的通用全模态生成系统 MiniMax H3。该系统统一了对文本、图像、视频和音频的多模态理解,并能够生成带有原生立体声、最高 2K 分辨率、时长可达 15 秒的视频。

H3 支持多种输入输出规格,包括文本生视频、图片生视频、视频生视频等多种模式,并支持 21:9 到 9:16 等多种宽高比。此外,模型还稳定支持包括中、英、日、韩等在内的 11 种对话语言。

所属事件:MiniMax 发布开源全模态模型 H3,支持原生 2K 音视频生成(14 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →