MiniMax H3 多模态生成:支持视频、图像、文本与音频混合输入
piotrbinkowski · x · 2026-08-02
MiniMax 发布了 H3 模型的多模态生成功能更新。
用户现在可以在一次生成中同时启用多种参考素材:
- 视频:用于提供动态参考
- 图像:用于指定视觉风格
- 文本:用于设定生成方向
- 音频:用于控制情绪与氛围
通过开启 H3 Multimodal Reference 功能,模型能够综合理解并融合上述多模态输入进行内容创作。
「多模态」频道最新
- AI 视频实操教程:如何保持角色对话一致性 — GreenFoxLeader · 2026-08-02
- 海螺 H3 视频模型 ComfyUI 本地版情报:8GB 显存可跑 480p — Gamerdudecedar · 2026-08-02
- Midjourney 8.2 复古胶片风:立体人像与漏光质感实测 — michaelrabone · 2026-08-02
- 马斯克感叹:过去需专业团队数月制作的特效,如今AI秒出 — elonmusk · 2026-08-02
- Grok Imagine 推出角色一致性功能,保持跨场景人物连贯 — XFreeze · 2026-08-02
- AI生成趣味短片:《毁灭者班比》第八集 — rad_city · 2026-08-02