想用 LoRA 训「广播剧生成器」?目前没有统一方案

wh33t · reddit · 2026-09-22

Reddit 用户探讨如何训练一个「音频广播剧」生成模型:现有 TTS、音乐、视频、音效生成器各自为政,没有任何系统能用一个统一 prompt 把对白和背景音效一起生成(比如开门吱呀声、混凝土上的靴子声、虎啸等)。作者想知道训练音频广播剧 LoRA 该用什么架构或平台,欢迎讨论。属于开放性问题求助,尚无答案或实操细节。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →