fal 上线 H3 Max 口型同步:一张照片加音频 11 秒出视频

jfischoff · x · 2026-09-19

fal 平台正式上线 H3 Max Lip Sync:上传一张照片和一段音频,即可在数秒内生成口型同步视频,支持自然表情与动作,任意语言均可用。官方评测中该模型在质量与速度均排名第一,生成时间中位数仅 11 秒。转发者评价其能力「 insane 」。

所属事件:fal 推出 H3 Max 唇形同步模型,质量与速度双居首(4 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →