ex-omni-avatar 用一个模型同步生成语音和说话头像
victormustar · x · 2026-07-25
HuggingApps 介绍的 ex-omni-avatar 指向一种更“全模态”的路线:一个模型接收用户输入后,同时协调生成语音回答和说话头像输出。
帖子也说明当前演示里的面部装置还不是真实拟真脸,但这部分在实际应用中可以替换。
「多模态」频道最新
- 用 MiniMax H3 MAX 对一只蚊子放大招,蚊子毫发无伤 — Hailuo_AI · 2026-09-11
- Skyfall GS 登场:用 Flux 提升 Gaussian Splatting 精修质量 — ducha_aiki · 2026-09-11
- AI 电影节 Lumara 将登陆纽约,顶级 AI 电影人齐聚评审 — 0xAllen_ · 2026-09-11
- 翼龙侦探:全程 AI 生成的概念片先导预告亮相 — PterodactylDetective · 2026-09-11
- Imperium 游戏预告片曝光,AI 视频生成再秀肌肉 — keaslenyt · 2026-09-11
- FLUX.2 Klein 换表情易丢脸,实测不如免费版 Gemini 保真 — wacomlover · 2026-09-11