MiniMax Music 3 模型现身 Hugging Face,支持 5 分钟长音频
NerdyRodent · x · 2026-08-14
MiniMax 在 Hugging Face 上发布了 MiniMax Music 3 音乐生成模型。
- 核心能力:支持生成长达 5 分钟的完整歌曲,能在长序列中保持音乐主题、节奏、人声和编曲的连贯演进。
- 技术架构:结合了 80 亿参数的全局 LLM(负责长程音乐结构)和 0.6 亿参数的局部 LLM(负责帧级声学细节),并采用基于 Flow Matching 和 Flow-VAE 的连续隐状态合成系统。
- 精细控制:支持通过歌词(含段落标签)和结构化音乐描述(流派、BPM、音色、情绪等)进行细粒度控制,输出 32kHz、16 位立体声 WAV 音频。
所属事件:MiniMax 发布开源 Music 3 音乐生成模型(17 条相关)→
「多模态」频道最新
- 求助:ComfyUI 中 MiniMax R2V 工作流怎么搭才稳? — haremlifegame · 2026-08-14
- Opus 5 与 Thrixel 演示:一次性生成可运行浏览器飞行游戏 — RanaHanocka · 2026-08-14
- 剪映全球上线 Seedance 2.5,发起视频续写挑战赛 — Aiden_Tech_Ai · 2026-08-14
- Python+Gemini白嫖批量生图:ComfyUI自动化工作流实战 — Excellent_Scene7402 · 2026-08-14
- Flux 3 文生视频实测:真实感与运镜表现惊艳 — gen_ericai · 2026-08-14
- H3模型实测:12GB显存10分钟生成10秒480p视频 — cocktailpeanut · 2026-08-14