H3视频模型实测:动作控制佳但速度慢,A100生成15秒需800秒

ReporterRemote6713 · reddit · 2026-08-06

Reddit用户分享了对Min Max H3视频生成模型的实测体验。整体而言,该模型在动作控制(如提示词引导的运动、接吻等全身肢体动作)方面表现出色,面部一致性可达8/10,且审查机制非常宽松。

性能方面,在A100 80G显卡上生成0.9像素分辨率的15秒竖屏视频大约需要800秒。用户指出使用官方推荐的提示词结构能获得更好的输出效果,目前正期待Turbo LoRA能进一步提升生成效率。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →