ex-omni-avatar 用一个模型同步生成语音和说话头像

victormustar · x · 2026-07-25

HuggingApps 介绍的 ex-omni-avatar 指向一种更“全模态”的路线:一个模型接收用户输入后,同时协调生成语音回答和说话头像输出。

帖子也说明当前演示里的面部装置还不是真实拟真脸,但这部分在实际应用中可以替换。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →