Wizstar 技术解析:双阶段音频驱动系统解决唇形同步

Shruti_0810 · x · 2026-08-26

Wizstar 采用双阶段音频驱动系统。首先分离语音、嘴部动作和头部姿态以独立驱动面部;随后恢复面部纹理和表情以增强真实感。该技术实现了精准的唇形同步、自然的头部运动,减少了模糊和变形,即使在嘴部被部分遮挡时也能保持稳定。

所属事件:Wizstar 单张照片生成口播数字人,登顶 Product Hunt(7 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →