voice-pro:集成零样本语音克隆与多语种翻译的 Gradio WebUI
abus-aikorea · github · 2026-08-01
开源项目 voice-pro 为创作者和开发者提供了一站式的 Gradio WebUI 音频处理方案。
该项目集成了 Edge-TTS、kokoro 等文本转语音(TTS)工具,支持基于 E2 & F5-TTS、CosyVoice 的零样本语音克隆。此外,它还整合了 Whisper 语音识别、YouTube 下载、Demucs 人声分离以及多语种翻译功能。
「多模态」频道最新
- 想训练Krea 2 LoRA生成印度风手机照片,网友支招 — desiNaughtyAI · 2026-08-01
- 实测:512分辨率生成+SeedVR2放大,效果等同2048高清直出 — More_Bid_2197 · 2026-08-01
- 字节跳动用Seedance 2.5在学习教育App中推送“电影感”课程 — JayaIsNotGemez · 2026-08-01
- Midjourney 风格代码与多工具联动创作超现实短片 — azed_ai · 2026-08-01
- xAI 升级 Imagine Video 1.5:新增文生视频、原生 1080p 与多参考生成 — testingcatalog · 2026-08-01
- 微软开源 TRELLIS.2:采用紧凑结构化隐变量的 3D 生成模型 — microsoft · 2026-08-01