Audio8 发布 0.1B 零样本多语言 TTS 模型

Audio8 · hf · 2026-08-23

Audio8 在 Hugging Face 发布了 Audio8-TTS-Preview-0.1b 模型。这是一个文本转语音(TTS)模型,参数量为 0.1B,支持多语言语音合成。该模型具备零样本(zero-shot)语音克隆能力,无需针对特定说话人进行微调即可模仿声音。它基于 Transformers 架构,采用 safetensors 格式,并集成了 arktts 技术。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →