独立研究者开源 Foundation-1,文本直接生成可演奏合成器
独立音频研究者 RoyalCities 发布并开源了自训音频模型 Foundation-1,可将文本 prompt 直接转换为可无限生成 one-shot 采样、且完全可演奏的合成器。其核心思路是把「乐器」与「音色」拆成两个独立可控维度,例如同一架钢琴既能呈现温暖粗粝的质感,也能切换其他风格,为声音设计提供了新的生成方式。
2026-09-10 ~ 2026-09-10 · 2 条相关
- 独立研究者开源音频模型:文本描述直接生成可演奏合成器 — RoyalCities · 2026-09-10
- 独立研究者自训音频模型:文本生成可演奏合成器并开源 — RoyalCities · 2026-09-10