STEER 开源:双向对话驱动的可控 3D 头部虚拟人面部动作生成
rsasaki0109 · x · 2026-09-17
SIGGRAPH Asia 2026 论文 STEER 开源了推理代码与项目页。STEER 是一个因果流匹配动作先验,用于生成两人对话中目标人物的 3D 面部动作,输出 61 维 FLAME 状态(表情、下颌、颈部、眼球旋转、眼睑),条件包括对方的动作与音频以及目标自身音频,并支持对注视、头部节奏与情绪的显式语义控制。仓库包含动作先验与动作自编码器推理管线、FLAME 可视化(含眼球/虹膜/瞳孔与眼睑渲染),输入打包示例即可生成目标动作并输出与对方动作并排对比的视频。
「多模态」频道最新
- Runway 发布 Enhance Frame Rate:视频插帧至 120fps,快 7 倍还便宜 3 倍 — Scobleizer · 2026-09-18
- a16z 合伙人 Justine Moore 将出席 fal GMC 2026 大会 — jfischoff · 2026-09-18
- Gemini 4 十分钟搭出空客 H145 直升机 3D 模型,多模态惊艳 — teortaxesTex · 2026-09-18
- Runway 推出 Model Router:按成本/质量/延迟自动选模型生成 — tlakomy · 2026-09-18
- 实测向分享:庆祝瞬间等 AI 修图提示词模板,保留真实脸型 — aitrendz_xyz · 2026-09-18
- 「我的一天」AI 修图提示词:强制保留五官肤色,背景轻微虚化 — aitrendz_xyz · 2026-09-18