开源 LongCat-Avatar:一张照片加音频生成数分钟对口型视频
Roger_M_Taylor · x · 2026-09-15
开发者转发热议的开源项目 LongCat-Avatar 引发关注:只需上传一张人物照片和一段音频,就能生成持续数分钟、口型同步的人物说话视频。这类能力此前需要摄像机、摄影棚和后期剪辑才能实现,如今直接来自一个开源仓库,且完全免费。发帖人称其「羞辱了整个付费 AI 视频行业」,仓库链接见评论。
「多模态」频道最新
- GPT-6 Astra 配 Hyper3D MCP,一张图一条 Agent 直接生成 3D 场景 — heyshrutimishra · 2026-09-15
- ElevenLabs MCP 全家桶:语音音乐图像视频一个 Agent 全搞定 — ZeroStateReflex · 2026-09-15
- ElevenLabs 推出全能 MCP,Claude 里一键生成音视频图像 — hey_abusiddik · 2026-09-15
- 5060 显卡本地跑 H3:两张参考图 12 秒视频耗时 57 分钟 — thatguyjames_uk · 2026-09-15
- 4060 Ti 实测:LTX 2.5 显存占用更优,为何大家仍选 H3 — ForesterAI · 2026-09-15
- MiniMax H3 借 SGLang+VDN 实现超 2 倍实时视频去噪 — MiniMax_AI · 2026-09-15