用合成语音蒸馏出固定音色泰语 TTS,可端侧部署
wayu-ai · hf · 2026-09-14
wayu-ai 在 Hugging Face 发布紧凑型泰语文本转语音模型:从大型声音克隆教师模型蒸馏,训练数据来自简短语音参考生成的合成语音。
- 实现端侧部署下的高准确度与自然韵律
- 错误率极低,采用固定音色方案
「多模态」频道最新
- Synthesia 发布 Express-3 数字人:口型更准、生成快 2 倍 — synthesiaIO · 2026-09-14
- 开源音乐模型 YuE2 发布:3B 本地跑,WildSongBench 超越 Suno v5/v6 — AdinaYakup · 2026-09-14
- 户型图转白模翻车:Astra 幻觉出与原图不符的相机位 — letandrewcook · 2026-09-14
- 别再让 ChatGPT「修图」了:10 条图片编辑提示词模板实测有效 — TawohAwa · 2026-09-14
- Seedance 2.5 新演示:运动中皮肤毛孔与碎发都真实可辨 — nikola_mr64990 · 2026-09-14
- 首部上星 AI 长剧《后西游记》:100 人干了 2000 人的活 — 创业邦 · 2026-09-14