KAIST 提出 AnyTalk:视频扩散模型生成任意角色语音动画

KAIST · hf · 2026-08-18

KAIST 发布论文 AnyTalk:在没有任何动画数据的前提下,为任意角色生成 3D 语音动画。

方法分两步:通过对视频扩散模型做角色特定微调,合成说话头像视频;再从合成的视频中优化 blendshape 参数得到可驱动的 3D 语音动画。团队还提供一个蒸馏后的实时版本。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →