OmniVoice 语音克隆模型微调后发音更准,支持 600 种语言
CeFurkan · reddit · 2026-10-07
Reddit 用户实测 OmniVoice 语音模型微调效果,称克隆出的声音与其本人音色一致,但发音更准确、词错率更低。
该模型支持 600 种语言和 0-shot 语音克隆,且显存需求很低。作者认为相比 0-shot 克隆,微调版本质上是质的提升。
所属事件:实测OmniVoice语音克隆:微调后发音更准(2 条相关)→
「多模态」频道最新
- Blender 城市生成器 2.0 发布,数秒生成完整 3D 都市 — Scobleizer · 2026-10-07
- Runway 推出 AI 伪纪录片《What We Forgot》,设定在 2030 年回望当下 — c_valenzuelab · 2026-10-07
- Diffusers 0.41 发布:支持 Qwen-Image 2.1,可原生输出透明图 — lmoroney · 2026-10-07
- AI 影视创企 Authors First 获超 1000 万美元种子轮助作家改编剧本 — DavidmComfort · 2026-10-07
- AI 生成的儿童节目《Bot Babies》亮相 Reddit — ScriptLurker · 2026-10-07
- ChatGPT Images 2.5 复刻 1946 年东京「废墟棒球」复古照片 — DeryaTR_ · 2026-10-07