fal 上线 H3 Max 唇形同步:照片+音频 3 秒生成说话视频

isidentical · x · 2026-09-18

fal 宣布 H3 Max Lip Sync 正式上线:任意照片配上音频,不到 3 秒即可生成对口型说话视频。官方称其基于市场上最快的视频模型 H3 Max,速度快到足以支撑大规模快速迭代,适用于多角色、多 campaign、多语言场景。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →