WordVoice TTS:逐词控制时长、响度、音高,0.5B小模型

multimodalart · x · 2026-07-24

WordVoice TTS 发布,支持对每个单词独立控制时长、响度、音高和语调。基于 CosyVoice3,可自动或手动控制,支持声音克隆和预设音色。模型仅0.5B参数,在同尺寸中表现优秀。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →