STEER 开源:双向对话驱动的可控 3D 头部虚拟人面部动作生成

rsasaki0109 · x · 2026-09-17

SIGGRAPH Asia 2026 论文 STEER 开源了推理代码与项目页。STEER 是一个因果流匹配动作先验,用于生成两人对话中目标人物的 3D 面部动作,输出 61 维 FLAME 状态(表情、下颌、颈部、眼球旋转、眼睑),条件包括对方的动作与音频以及目标自身音频,并支持对注视、头部节奏与情绪的显式语义控制。仓库包含动作先验与动作自编码器推理管线、FLAME 可视化(含眼球/虹膜/瞳孔与眼睑渲染),输入打包示例即可生成目标动作并输出与对方动作并排对比的视频。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →