北大团队发布 Motion-Omni:语音对话与全身动作实时同步生成
PKU1898 · hf · 2026-09-07
PKU1898 在 Hugging Face 发布 Motion-Omni,一个端到端框架,可从共享隐状态同时生成口语对话与全身共语动作。
关键点:
- 采用可扩展的伪标签方法解决共语动作数据稀缺问题
- 提供统一的评估协议
- 目标是实现实时、语音与动作对齐的响应,面向具身/数字人场景
「具身」频道最新
- HiSfM:骨架锚定分层重建,破解重复对称结构的SfM歧义 — zhenjun_zhao · 2026-09-07
- GPT-6 写脚本跑 openEMS 仿真,自动优化高速 PCB 焊盘阻抗 — BLUECOW009 · 2026-09-07
- 实测 Meta 眼镜指挥个人 agent:穿戴设备缺的只是拼图 — kleffew94 · 2026-09-07
- Neuralink 第 23 位患者仅凭意念操控机械臂和光标 — tetsuoai · 2026-09-07
- whurley 亲历 Uber 险撞车:CyberCab 大概不会犯这个错 — whurley · 2026-09-07
- ECCV 2026 Oral:Poppy 用偏振光免训练提升单目法线估计 — ssh4net · 2026-09-07