fal 上线 H3 Max 口型同步:一张照片加音频 11 秒出视频
jfischoff · x · 2026-09-19
fal 平台正式上线 H3 Max Lip Sync:上传一张照片和一段音频,即可在数秒内生成口型同步视频,支持自然表情与动作,任意语言均可用。官方评测中该模型在质量与速度均排名第一,生成时间中位数仅 11 秒。转发者评价其能力「 insane 」。
所属事件:fal 推出 H3 Max 唇形同步模型,质量与速度双居首(4 条相关)→
「多模态」频道最新
- Gemini 语音口音实测:提示词里指定口音,非英语效果大不同 — juberti · 2026-09-19
- LTX 2.5 CQ 增强 Loqa 效果惊人,0.2MP 视频修复前后反差大 — blastbottles · 2026-09-19
- Grok Imagine Image 2.0 登顶外 OpenAI 第一,文生图榜排名跃升 14 位 — ArtificialAnlys · 2026-09-19
- Modal×Gray Area 公布 13 位 AI 艺术委托名单,每人获 2 万美元算力 — charles_irl · 2026-09-19
- AI 短片《Straw Tears》晒全流程:Midjourney 加 Seedance2 全套工具链 — LudovicCreator · 2026-09-19
- 用 Higgsfield Genjutsu 生成真人同框 AI 视频 — chrisfirst · 2026-09-19