MiniMax 开源 Music 3 音乐生成模型
MiniMax 正式发布并开源了 Music 3 音乐生成模型,权重已在 Hugging Face 平台开放并登顶趋势榜。该模型结合了 80 亿参数的全局 LLM 与 27 亿参数的 DiT 架构,能够根据提示词和歌词生成最长 5 分钟的完整歌曲,号称实现了 SOTA 级别的歌曲生成能力。模型对消费级显卡友好,为开发者和创作者提供了极具潜力的本地音频生成工具。
已确认
- 模型架构:采用 8B 参数的 LLM 与 2.7B 参数的 DiT 架构相结合的技术方案,底层基于 PyTorch。
- 生成能力:能够根据输入的提示词和歌词,生成最长 5 分钟的完整歌曲,具备长程结构连贯性、富有表现力的人声以及演变的编曲,且长音频质量稳定。
- 生态适配:模型已适配 🧨 Diffusers 和 ComfyUI,且支持在消费级 GPU 上运行,降低了本地部署的硬件门槛,可与现有的视频、图像及 LLM 工具组合构建多模态工作流。
时间线
- 08-13:有开发者在 Hugging Face Diffusers 库中发现关于该模型的 PR,且官方已提交多个生成样例供试听。
- 08-14:Comfy-Org 在 Hugging Face 上发布该模型,随后官方正式宣布开源并开放权重,模型迅速冲上平台趋势榜。
为什么重要
MiniMax Music 3 声称实现了 SOTA 级别的歌曲生成能力,且对消费级显卡的友好支持,为开发者、创作者及开源社区提供了可直接用于生产的全能音乐模型,极大丰富了本地 AI 工具生态。
2026-08-13 ~ 2026-08-14 · 13 条相关
一手来源
- MiniMax-Music3 模型登顶 Hugging Face 趋势榜 — MiniMaxAI ·
- MiniMax Music 3 开源:消费级 GPU 可跑 — multimodalart ·
- Minimax Music 3 音乐模型即将开源,样例已曝光 — rerri ·
- 【源头】Minimax Music 3 音乐模型即将开源,样例已曝光 — rerri · 2026-08-13
- 【源头】MiniMax Music 3 开源:消费级 GPU 可跑 — multimodalart · 2026-08-14
- MiniMax-Music-3 模型已上线 Hugging Face — LadyQuacklin · 2026-08-14
- MiniMax 发布 Music3 音乐生成模型 — Sea_Tomatillo1921 · 2026-08-14
- MiniMax 发布 Music 3:支持生成 5 分钟完整歌曲 — huggingface · 2026-08-14
- MiniMax 发布 Music3:新一代开源音乐生成大模型 — bennash · 2026-08-14
- 【源头】MiniMax-Music3 模型登顶 Hugging Face 趋势榜 — MiniMaxAI · 2026-08-14
- MiniMax 发布开源音乐模型 Music 3,SGLang 率先支持 — ying11231 · 2026-08-14
另有 5 条近重复转述:multimodalart · PurzBeats · multimodalart · BanghuaZ · Acceptable-Cycle4645