fal 上线 H3 Max 唇形同步:照片加音频数秒出视频
fal 正式上线 H3 Max Lip Sync:上传一张照片和一段音频,数秒内即可生成唇形同步的说话视频,官方评测称其在质量与速度两项均排名第一,中位生成时间仅 11 秒。
已确认
- 产品功能:用户上传一张照片加一段音频,即可生成对口型说话视频,支持任意语言,表情与动作自然。
- 性能:据 fal 官方评测,模型在质量与速度上均排名第一,生成中位耗时仅 11 秒;isidentical 的发帖也提到「不到 3 秒即可生成」的表述,两条数据并存于官方宣传中。
- 技术来源:模型基于市场上最快的视频模型 H3 Max。阿拉伯语博主 aziz4ai 介绍,fal 平台是对 MiniMax H3 Max 模型做了微调定制。
- 应用场景:官方称其速度足以支撑大规模快速迭代,适用于多角色、多 campaign、多语言场景;aziz4ai 还强调其价格非常便宜,认为这是目前最强的唇形同步方案。
尚未确认
- 「质量与速度双第一」的结论来自 fal 自家评测,尚无第三方独立评测佐证;「3 秒」与「11 秒」两个生成时间口径不一,具体取决于场景或任务规模。
为什么重要
- 唇形同步是广告投放、多语言内容本地化和虚拟角色制作的关键环节,H3 Max 以秒级生成速度和低成本,使大规模批量迭代成为可能,可能改变此类内容的生产成本结构。
2026-09-18 ~ 2026-09-19 · 5 条相关
一手来源
- fal 上线 H3 Max 唇形同步:照片+音频 3 秒生成说话视频 — isidentical ·
- fal 上线 H3 Max 口型同步:一张照片加音频 11 秒出视频 — jfischoff ·
- 【源头】fal 上线 H3 Max 唇形同步:照片+音频 3 秒生成说话视频 — isidentical · 2026-09-18
- fal 推出 H3 Max 唇形同步模型:中位生成仅 11 秒,质量速度双第一 — jfischoff · 2026-09-19
- fal 上微调的 MiniMax H3 Max 唇形同步又快又便宜 — aziz4ai · 2026-09-19
另有 2 条近重复转述:jfischoff · isidentical