H3 T2VA 实测:分层提示词效果优于 R2VA

SIR_NVAX_A_LOT · reddit · 2026-08-21

用户分享了视频生成模型 H3 的使用体验。作者认为通过叠加提示词的 T2VA(Text to Video with Audio)模式实际上比 R2VA 更强。不过,如果需要利用角色表单或保持角色一致性,FL2VA+R2VA 依然是首选方案,且其语音克隆功能表现顶尖。帖子展示了使用 T2VA (bf16/50 steps) 生成的内容。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →