Wan-Dancer-14B 开源:支持音乐生成长时长舞蹈视频

阿里 Wan-AI 团队近期发布并开源了 Wan-Dancer-14B 视频生成模型。该模型主打“music-to-dance”能力,用户只需上传角色图像并添加音乐,即可生成与节奏同步的舞蹈视频。此举备受瞩目,因为它直接瞄准了长时长、高质量的舞蹈生成难点,试图突破现有扩散视频模型在 20 秒左右容易失稳的瓶颈。

关键能力与细节

Wan-Dancer-14B 被定义为一个带有音乐转舞蹈能力的图生视频管线。据帖子介绍,其核心思路是从完整音乐出发,生成长时长、高分辨率且与节拍同步的舞蹈视频,同时强调全局结构和时间连续性。在生成时长方面,该模型单次生成时长最高可达 3 分钟。这也是 Wan 团队推出的第三或第四个舞蹈方向的变体模型。

开源动态与各方反应

官方账号 @Wan-AI 确认,Wan-Dancer-14B 目前已在 Hugging Face 上获得 trending 关注。同时,Wan 团队明确表示将继续坚持开源路线,该模型已支持在本地生成长时长、节奏感强的舞蹈视频。这一举措被观察者视为 Wan 团队推进开源生态的又一有力例证,也有发帖者评价该模型“看起来很有前景”。

2026-07-13 ~ 2026-07-14 · 6 条相关

一手来源