开源 LongCat-Avatar:一张照片加音频生成数分钟对口型视频

Roger_M_Taylor · x · 2026-09-15

开发者转发热议的开源项目 LongCat-Avatar 引发关注:只需上传一张人物照片和一段音频,就能生成持续数分钟、口型同步的人物说话视频。这类能力此前需要摄像机、摄影棚和后期剪辑才能实现,如今直接来自一个开源仓库,且完全免费。发帖人称其「羞辱了整个付费 AI 视频行业」,仓库链接见评论。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →