NVIDIA 推出 Audio2Face-3D,音频驱动高保真面部动画
tom_doerr · x · 2026-08-23
NVIDIA 发布了 Audio2Face-3D,这是一项能从音频源生成高保真 3D 面部动画的技术,支持预录制文件和实时流。
核心能力:
- 精准唇形同步:基于语音分析合成精确的下颚、舌头和眼睛运动。
- 情感推断:从语音语调中推断细腻的情感表达,并结合面部皮肤细微变形。
- 多种驱动方式:支持直接网格变形、关节变换或混合形状权重来驱动角色表演。
工具链:
该技术中心提供预训练模型、开发 SDK,以及用于 Autodesk Maya 和 Unreal Engine 5 的插件,并附带示例数据集。
「多模态」频道最新
- AI视频新突破:10分钟故事锁定7个角色4个场景一致性 — mygreenmyblue · 2026-08-23
- Midjourney 配合 H3 一键生成高质量片头 — techhalla · 2026-08-23
- 12GB显存笔记本跑通MiniMax H3视频生成,人脸细节成瓶颈 — sarasa_0505 · 2026-08-23
- 用户宣布在本地成功部署类 Sora 视频生成模型 — nptacek · 2026-08-23
- 重温老帖:用提示词在潜在空间里「走进」虚拟环境 — nptacek · 2026-08-23
- H3 视频生成实测:复杂场景的人物行为控制为何全靠运气? — Hdfjds · 2026-08-23