开源实时流式TTS模型Gepard 1.0发布

团队正式开源了面向实时对话场景的流式文本转语音(TTS)模型Gepard 1.0。该模型参数量约为5.55B,采用流式优先设计,文本到达即可开始逐帧生成音频,无需等待整句结束。模型主打生成速度快且音质出色,目前已采用Apache 2.0许可证开源,并在Hugging Face平台提供了在线演示。

2026-07-08 ~ 2026-07-08 · 2 条相关