MiniMax 发布 H3 模型:原生支持 2K 音视频生成

Mobile-Pumpkin7944 · reddit · 2026-08-03

MiniMax 官方发布了通用全模态生成系统 MiniMax-H3。该模型统一了文本、图像、视频和音频的多模态上下文理解能力。

在生成方面,H3 能够输出带有原生立体声的最高 2K 分辨率视频,时长可达 15 秒。得益于面向任务泛化的系统设计,它在预训练阶段就具备了广泛的多模态指令遵循能力。

所属事件:MiniMax 发布开源全模态模型 H3,支持原生 2K 立体声视频(13 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →