Avatar X 被赞能让表情跟上非语言音频
Scobleizer · x · 2026-07-29
这条帖子的重点不是“嘴型像不像”,而是模型能否处理笑声、哭声、打哈欠等非语言音频线索。
作者认为,大多数 avatar 模型在这些时刻只能勉强做口型同步,脸部表情会和声音脱节;而 Avatar X 是他测试过的唯一一个能让表情和声音保持一致的模型。
所属事件:Mirage 发布 Avatar X:10秒生成高保真数字人(12 条相关)→
「多模态」频道最新
- Midjourney v8.2 生成「3050年」概念图展示 — Angaisb_ · 2026-07-29
- Claude Code 用约 400 万 token 在 9 小时内做出 WebGPU 雪地 demo — Any-Reputation8118 · 2026-07-29
- 4张 RTX 6000 实测视频生成:3秒1080p耗时20分钟 — NewVeterinarian5384 · 2026-07-29
- Midjourney v8.2新玩法:--no参数与个性化配置实测 — michaelrabone · 2026-07-29
- VEED 上线 fal 平台:推出多款视频生成与处理 API — gorkem · 2026-07-29
- Midjourney 极致写实人像提示词:精准控制光影与细节 — SimplyAnnisa · 2026-07-29