fal 推出 H3 Max 唇形同步模型:中位生成仅 11 秒,质量速度双第一
jfischoff · x · 2026-09-19
fal 正式上线 H3 Max Lip Sync:用户上传一张照片和一段音频,几秒内即可生成唇形同步视频,表情与动作自然,支持任意语言。
据 fal 自家评测,该模型在质量与速度两项均排名第一,中位生成时间仅 11 秒。开发团队 isidentical 介绍,他们用扩散强化学习(diffusion RL)拓展到新的可验证任务上,唇形同步正是其中之一——这个方向的惊喜在于它可以通过 RL 持续优化,最终做出据称全球质量最高、最快也最便宜的 lip-sync 模型,底层构建在 fal 的 H3 Max 架构之上。
所属事件:fal 推出 H3 Max 唇形同步模型,秒级生成说话视频(3 条相关)→
「多模态」频道最新
- LTX 2.5 原生修补功能实测:配合 IC-Lora 精准控制视频编辑 — No-Property3068 · 2026-09-19
- Grok Imagine 9 天做出好莱坞级片段:3627 张图仅花 2677 美元 — NicoVerderosa · 2026-09-19
- Reddit 分享:意式 80/90 年代 Canzone 风格音乐 LoRA — -becausereasons- · 2026-09-19
- Invideo 编辑器上线 Sound Design:Agent 自动分析并修复视频音效 — azed_ai · 2026-09-19
- 从 GTX1070ti 升级 RTX5070ti 后,Comfy 生成提速超十倍 — Nesachi1 · 2026-09-19
- 用户用 Seedance 2 制作 AI 狩猎短片引发关注 — Ok-Nerve941 · 2026-09-19