Ref2VA 模型实测:3 张参考图精准复刻人物音视频
rjay7979 · reddit · 2026-08-05
一位开发者展示了使用 Ref2VA 模型进行音频驱动视频生成的实测效果。在该演示中,用户仅需提供 3 张不同对象的参考图片,外加一段 Gilbert Gottfried 的音频片段作为参考,模型即可生成对应的视频。作者还特别测试了模型是否原生“认识”该名人的声音。
「多模态」频道最新
- Seedance 2.5 实测:双参考图丝滑生成连贯视频 — chrisfirst · 2026-08-05
- WAN 3 视频模型疑似泄露,实测版权内容生成能力 — ChrisGPT · 2026-08-05
- 12G 显存跑满血 Flux 模型:旧显卡本地生图实践 — TheRealFutaFutaTrump · 2026-08-05
- Anthropic 签百亿算力大单,FLUX 3 视频模型发布 — soumitrashukla9 · 2026-08-05
- 开发者开源多语言教育视频生成系统 SarasFlow — sai_teja_ · 2026-08-05
- AI 视频 Demo:东京动画重生计划 — TomatoJutsu · 2026-08-05