MiniMax 发布 H3 多模态视频模型并支持 ComfyUI

MiniMax 发布了全新的开源多模态视频模型 H3。该模型具备强大的跨模态处理能力,能够同时解析并处理文本、图像、视频和音频等多种数据类型,支持联合生成视觉与音频内容。目前 H3 已上线 ComfyUI,用户可借此进行文生视频、图生视频、首尾帧生成等创作,并能实现 15 秒 768p 分辨率的视频生成。

2026-08-10 ~ 2026-08-11 · 2 条相关

事件全程(共 4 集)→