KAIST 提出 AnyTalk:视频扩散模型生成任意角色语音动画
KAIST · hf · 2026-08-18
KAIST 发布论文 AnyTalk:在没有任何动画数据的前提下,为任意角色生成 3D 语音动画。
方法分两步:通过对视频扩散模型做角色特定微调,合成说话头像视频;再从合成的视频中优化 blendshape 参数得到可驱动的 3D 语音动画。团队还提供一个蒸馏后的实时版本。
「多模态」频道最新
- 用 MeshyAI 将照片转彩色 3D 模型全流程 — filiksyos · 2026-08-18
- AI修图污染公民科学库:绿鹭被Gemini修出第三条腿 — kscottz · 2026-08-18
- 说话数字人口感变了:唇同步过关后,下颌与表情才露馅 — admrys · 2026-08-18
- 孟买季风微型雨云创意:摄影级AI提示词连续场景演示 — CurieuxExplorer · 2026-08-18
- 纯 Three.js 实现,静态图秒变可操控 3D 角色 — Scobleizer · 2026-08-18
- Seedance 2.5 生成葛饰北斋风格生物发光海浪 — CurieuxExplorer · 2026-08-18