0.6B 开源语音模型 Audio8-TTS 发布:支持零样本克隆
bigblueboo · x · 2026-07-30
开发者 @SamuelZengML 宣布开源 Audio8-TTS Preview 语音模型。尽管参数量仅为 0.6B,但具备强大的语音能力,支持 11 种语言、零样本(Zero-shot)语音克隆,并内置 44.1 kHz 编解码器,采用 Apache 2.0 开源协议。
博主 @bigblueboo 对此表示期待,并计划将其接入个人的 Pocket-clone(本地阅读类应用)中进行测试,看它能否取代目前常用的 voxcpm2 模型。
所属事件:Audio8-TTS 预览版登顶 Hugging Face 趋势榜(2 条相关)→
「模型」频道最新
- 用户质疑 Gemini Plus 订阅费:19.99 美元还是隐藏扣费? — fuad471 · 2026-07-30
- 开源权重只是静态存档,无法像开源软件一样沉淀社区贡献 — shashib · 2026-07-30
- LightOnOCR-2-1B 登顶 Hugging Face 热门,专攻复杂文档解析 — lightonai · 2026-07-30
- Kimi K3 第三方 API 实测:Fireworks 性能最接近官方 — iScienceLuvr · 2026-07-30
- Snorkel 职业能力评测:Grok 4.5 在 16 项中拿下 14 项第一 — XFreeze · 2026-07-30
- 用户称服务器宕机,Opus 5误以为被指责承认抑郁 — repligate · 2026-07-30