Avatar X 被赞能让表情跟上非语言音频

Scobleizer · x · 2026-07-29

这条帖子的重点不是“嘴型像不像”,而是模型能否处理笑声、哭声、打哈欠等非语言音频线索。

作者认为,大多数 avatar 模型在这些时刻只能勉强做口型同步,脸部表情会和声音脱节;而 Avatar X 是他测试过的唯一一个能让表情和声音保持一致的模型。

所属事件:Mirage 发布 Avatar X:10秒生成高保真数字人(12 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →