开源 TTS 模型 Sopro V2 Turbo 2610:120M 参数,笔记本 CPU 约 300ms 出声
SammyDaBeast · reddit · 2026-10-04
开源语音克隆模型 Sopro V2 Turbo 发布 2610 中间版本,主要修复用户反馈的克隆声音粗糙、破音问题。
要点:
- 模型仍是 120M 参数,速度不变,笔记本 CPU 上约 300ms 出首段音频,支持真流式输出
- Apache-2.0 开源,支持英语、欧葡、法语、德语,更多语言与声音控制开发中
- 已知短板:尖细/卡通声线、嘈杂参考音频及部分分布外声音仍表现不佳,作者征集失败样本
- 提供 uvx 一行命令本地运行、GitHub 仓库、HuggingFace 权重、浏览器 demo 和评测博客
适合喜欢 F5-TTS 但想要更轻量、可在 CPU 舒畅运行且真流式的用户。
「多模态」频道最新
- LudovicCreator 公开超写实文生视频 Prompt:镜中涌出海洋吞噬房间 — LudovicCreator · 2026-10-04
- 只改一个词:「玻璃牧羊人」雾中领路的 Midjourney 意象实验 — tisch_eins · 2026-10-04
- 不开视频剪辑软件:用 Codex + GPT-6.1 做出 30 秒动效宣传视频 — No-Hunter9792 · 2026-10-04
- 快手可灵发布 Kling 4.0 Flash 快速版视频模型 — azed_ai · 2026-10-04
- AI 电影感玩法:提取参考镜头运动,保留空间换掉画面 — alifcoder · 2026-10-04
- Cloudflare 在 HF 发布视觉模型 clef,作者喊话 Perplexity 接入 — ostrisai · 2026-10-04