不止于视频生成:网友挖掘出 Minimax H3 隐藏的图像编辑与语音克隆能力
Resident_Sympathy_60 · reddit · 2026-08-03
Reddit 网友实测发现,Minimax H3 不仅仅是一个视频生成模型,还能作为全能的多模态工具使用。
主要隐藏功能:
- 图像编辑: 将时长设为极短并配合参考图,可实现换脸或场景变换。
- 音频生成: 设定特定分辨率并输入台词,模型可实现 TTS 语音克隆及情感表达。在 B300 显卡上接近实时生成,10秒对话仅需8秒处理时间。
- 背景消除: 可通过 Prompt 直接指令去除画面背景中的特定元素。
该模型目前处于无审查状态,社区正积极挖掘其更多潜力并期待 LoRA 的适配。
所属事件:MiniMax 海螺 AI 推出 H3 视频模型,实测多模态能力惊艳(7 条相关)→
「多模态」频道最新
- 实测 Seedance 2.5:30 秒一镜到底演绎乐器无缝变换 — LinusEkenstam · 2026-08-04
- 字节 Seedance 2.5 上线:单次生成 30 秒,支持 50 个多模态参考素材 — SucceededMind · 2026-08-04
- Ostris AI Toolkit 支持 MiniMax H3 视频模型训练 — ostrisai · 2026-08-04
- Ostris AI Toolkit 支持 MiniMax H3 视频模型 LoRA 训练 — ostrisai · 2026-08-04
- 精准理解复杂指令,多模态模型 Omni 生成动态 UI — fofrAI · 2026-08-04
- Runway 即将上线 Seedance 2.5,新订阅可享 7 天无限生成 — runwayml · 2026-08-04