开源实时流式TTS模型Gepard 1.0发布
团队正式开源了面向实时对话场景的流式文本转语音(TTS)模型Gepard 1.0。该模型参数量约为5.55B,采用流式优先设计,文本到达即可开始逐帧生成音频,无需等待整句结束。模型主打生成速度快且音质出色,目前已采用Apache 2.0许可证开源,并在Hugging Face平台提供了在线演示。
2026-07-08 ~ 2026-07-08 · 2 条相关
- 开源实时流式 TTS 模型 Gepard 1.0 发布 — ylankgz · 2026-07-08
- Gepard 1.0 发布语音合成模型 — victormustar · 2026-07-08