MiniMax 发布 Music 3:支持生成五分钟完整歌曲
PurzBeats · x · 2026-08-14
MiniMax 在 Hugging Face 上发布了高性能音乐生成模型 MiniMax Music 3,能够根据歌词和详细的音乐描述生成最长 5 分钟的完整歌曲。
技术架构:
- 结合了 80 亿参数的全局 LLM(负责长程音乐结构)和 6 亿参数的局部 LLM(负责帧级声学细节)。
- 采用基于 Flow Matching 和 Flow-VAE 的连续隐状态合成系统。
- 输出 32 kHz、16 位立体声 WAV 音频。
控制能力:
- 支持精细的音乐控制,接受歌词和音乐描述双重输入。
- 歌词支持添加如 [Verse]、[Chorus] 等段落标签。
- 音乐描述支持结构化提示词,可精确定义流派、BPM、调性、情感走向、人声性别及音色等全局元数据与演唱细节。
所属事件:MiniMax开源Music3音乐模型,支持生成5分钟歌曲(11 条相关)→
「模型」频道最新
- Arcee 开放模型 API 测试版上线,整合 DeepSeek 与 Kimi 等 — latkins · 2026-08-14
- WebDev Arena 榜单:Claude Opus 5 Max 领跑前端开发 — arena · 2026-08-14
- Gemini 3.7 Flash 跑分大跃升,文本榜单冲至第 9 — arena · 2026-08-14
- Arcee AI 开源长任务智能体框架 NAC — latkins · 2026-08-14
- Gemini 3.7 Flash 发布,首发定价仅为上代一半 — fofrAI · 2026-08-14
- 谷歌发布 Gemini 3.7 Flash,年底前价格直降50% — osanseviero · 2026-08-14