Minimax H3 实测:用“口技”人声做音乐参考的尝试与问题
Portable_Solar_ZA · reddit · 2026-08-23
作者尝试在 Minimax H3 中使用人声模仿乐器(口技)作为音频参考来生成音乐。
遇到的问题:
- 使用 Reference Model 时,AI 坚持将原人声保留在输出音轨中,导致人声与背景音乐混合,而非仅保留节奏。
- 测试 非 Reference Model 时,意外发现它成功去掉了人声,只保留了生成的节奏,效果更符合预期。
作者正在寻求如何在使用 Reference Model 的同时去除原人声的解决方案。
「多模态」频道最新
- 描述梦境给AI龙,它即生成星球带你体验 — repligate · 2026-08-24
- 用金缮纹理修复3D模型编辑后的裂缝 — repligate · 2026-08-24
- 用 FL2VA 模型制作汉尼拔角色视频 — Nimblecloud13 · 2026-08-24
- MiniMax H3 助力复活中世纪短视频创作,工作流全公开 — zanatas · 2026-08-24
- NAPE 音频预训练法开源:无解码器 SOTA — kastnerkyle · 2026-08-24
- H3 模型生成复杂太空场景效果惊艳 — SIR_NVAX_A_LOT · 2026-08-24