仅 29.6M 参数的开源 TTS 模型 SupraTTS 发布,可在 CPU 端侧运行
LH-Tech_AI · reddit · 2026-09-27
SupraLabs 发布开源 TTS 模型 SupraTTS-0.1-Beta,仅约 2960 万参数,基于 Glow-TTS 架构,音质略优于同尺寸的原版 Glow-TTS。
模型已上线 Hugging Face,主打轻量部署,适合小型边缘设备和 CPU 推理。团队预告后续将加入更好音质、多语言、多音色、情感与说话风格,以及零样本声音克隆。
「多模态」频道最新
- --sref 1932900952:一个被分享的 Midjourney 风格码 — sergeantsref · 2026-09-28
- Suno 谱曲 + AI 音乐视频:Babak Hodjat 把秋日灵感做成完整作品 — Kyrannio · 2026-09-28
- 微缩场景惊现巨型火鸟,视觉反差拉满 — microx-3d · 2026-09-28
- Reddit 用户用 AI 生成谍战片《The College》首曝前 20 秒 — barnowl5 · 2026-09-27
- 用 Claude 15 分钟复刻任意产品发布视频,作者开源完整 Prompt — alexmacgregor__ · 2026-09-27
- AI 生成《瑞克和莫蒂》真人版:作者再试一版 — ForeverNecessary7377 · 2026-09-27