Meta 发布 Muse Realtime Avatar,语音驱动实时数字人对话
alexandr_wang · x · 2026-09-24
- Meta AI Research 发布 Muse Realtime Avatar,把 Muse Realtime Voice 的语音流实时变成可对话的数字化身:人像照片能有细腻表情,全身插画会做手势、变换姿态,动物和日常物品也能被赋予表现力,且跨对话轮次保持外观与动作连贯。
- 技术上,语音与形象共享同一 token 流:模型是音频驱动的 Diffusion Transformer,以语音 token、参考媒体和近期视频 latent 滚动窗口为条件,按因果短块生成视频,前一块的 latent 成为下一块的运动上下文,使生成可持续整场对话且计算量有界。
- Meta 称模型生成的所有内容都带 AI 水印且不增加延迟,这是其产品线实时具身 AI 的基础。官方还与 Runway Characters、HeyGen LiveAvatar 做了真人对比测试,称用户更喜欢 Muse。
所属事件:Meta 推出 Muse 实时数字人,盲测胜过 HeyGen 与 Runway(3 条相关)→
「多模态」频道最新
- Meta AI 三年演进:从 Threads 到视频模型 Muse — minchoi · 2026-09-24
- 实时交互团队成果登上 Meta Connect 舞台 — EdwardSun0909 · 2026-09-24
- 全 AI 生成 14 分钟剧集《Bride Of The Atom》第一集上线 — geekycheekypixels · 2026-09-24
- DS 4.1 Flash 用 Blender 做 3D 动画:开源小模型也有视觉创作力 — bookwormengr · 2026-09-24
- Muse 推出 Pixar 风格语音生成,Scale AI CEO 晒产品喊话体验 — alexandr_wang · 2026-09-24
- 用户实测视频生成新模型:动画生成速度惊人,语音一次过 — ZeroStateReflex · 2026-09-24