ECCV 2026:Odoriko 结合体形的统一多模态动作生成

mittu1204 · x · 2026-08-31

现有统一多模态动作生成框架忽略了体型(如性别、身体形状)对运动学的影响,将所有主体视为形态等价。Odoriko 是首个在统一框架(文本、音乐、视频)中融入生物形态信息的模型,能根据“谁在动”生成一致的动作。在缺乏显式形态信息时,它还能联合恢复形态与动作。实验表明,其在文本/音乐/视频驱动任务上达到或超越专用模型水平,并支持形态一致性生成。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →