0.6B 开源语音模型 Audio8-TTS 发布:支持零样本克隆

bigblueboo · x · 2026-07-30

开发者 @SamuelZengML 宣布开源 Audio8-TTS Preview 语音模型。尽管参数量仅为 0.6B,但具备强大的语音能力,支持 11 种语言、零样本(Zero-shot)语音克隆,并内置 44.1 kHz 编解码器,采用 Apache 2.0 开源协议。

博主 @bigblueboo 对此表示期待,并计划将其接入个人的 Pocket-clone(本地阅读类应用)中进行测试,看它能否取代目前常用的 voxcpm2 模型。

所属事件:Audio8-TTS 预览版登顶 Hugging Face 趋势榜(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →