Audio8 推出 0.1B 参数 TTS,支持 11 语种零样本克隆

alexcovo_eth · x · 2026-08-26

Audio8 发布了 0.1B 参数的预览版 TTS 模型,支持 11 种语言和零样本语音克隆。模型已在 Hugging Face 上提供 ONNX INT8 版本,可在仅约 0.4GB RAM 的 CPU 上运行,无需 PyTorch 或 CUDA。该模型输出 44.1kHz 音频,提供 OpenAI 兼容的 API,采用 Apache 2.0 开源协议。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →