WanSong:五分钟长歌生成模型

Wan-AI · hf · 2026-07-17

## WanSong v1.0:面向长篇歌曲生成的纯扩散模型 Wan-AI 发布 **WanSong v1.0** 技术报告,目标是做“商业级”的长篇歌曲生成。作者认为当前音乐生成的难点在于:既要高保真、又要长时长,还要支持可控和定制。 ### 模型特点 - 采用**纯扩散**方案,而不是 AR 或级联多阶段流水线 - 可直接生成最长 **5 分钟** 的高保真、多语言歌曲 - 一次生成即可输出双轨:**人声 + 伴奏** - 支持通过 **step-distillation** 提升推理速度 - 也提供较高效的微调和定制路径,便于下游编辑任务 这篇报告的重点不在单点 demo,而是把长篇音乐生成的效率、质量和可控性一起往前推进。

所属事件:Wan 团队发布 WanSong 音乐生成模型(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →