Meta 发布 Muse 实时数字人:语音视频同步,响应不到一秒
Scobleizer · x · 2026-09-24
Meta 官方宣布 Muse Realtime Avatar,与 Muse Realtime Voice 配套,可让任意角色进入实时对话——说话时同步生成动画,语音与视频同步,首字响应不到一秒,可无限时长持续聊天。
工程负责人 kakemeister 透露,团队两年前从 Waveforms 加入 Meta 后,一直在重建 Meta 的实时 AI 推理栈,以支撑大规模实时语音与视频对话。他指出实时多模态推理是 AI Infra 中最复杂的问题之一,横跨模型与硬件优化、LLM 编排和 RTC 全栈;尤其是算力受限的扩散式视频模型,对延迟和成本提出了全新挑战,他们的工作让这类模型能以低延迟、低成本规模服务。
Meta 首席 AI 官 Alexandr Wang 称之为 SOTA 级模型。
所属事件:Meta 发布 Muse Realtime Avatar 实时数字人(5 条相关)→
「Infra」频道最新
- 曝 Modal 与 Baseten 正洽谈融资,助企业运行 AI 负载 — dinabass · 2026-09-24
- 哥伦比亚大学 CUbiC 论文探讨边缘到云 AI 基础设施与 CPO 路线 — jwt0625 · 2026-09-24
- 混元研究:调学习率扩大 batch size,PPO 训练吞吐提升至 2.29 倍 — TencentHunyuan · 2026-09-24
- Alchemy 为状态存储加 Cloudflare Access 保护,支持 CI 服务令牌 — samgoodwin89 · 2026-09-24
- 一条 prompt 让 agent 自己核算账单:价格涨还是用量涨? — gethackteam · 2026-09-24
- 内核启动 50μs 延迟的代价:通用推理框架难以复刻单模型专有优化 — AlpinDale · 2026-09-24