Audio8 发布 0.1B 零样本多语言 TTS 模型
Audio8 · hf · 2026-08-23
Audio8 在 Hugging Face 发布了 Audio8-TTS-Preview-0.1b 模型。这是一个文本转语音(TTS)模型,参数量为 0.1B,支持多语言语音合成。该模型具备零样本(zero-shot)语音克隆能力,无需针对特定说话人进行微调即可模仿声音。它基于 Transformers 架构,采用 safetensors 格式,并集成了 arktts 技术。
「多模态」频道最新
- 描述梦境给AI龙,它即生成星球带你体验 — repligate · 2026-08-24
- 用金缮纹理修复3D模型编辑后的裂缝 — repligate · 2026-08-24
- 用 FL2VA 模型制作汉尼拔角色视频 — Nimblecloud13 · 2026-08-24
- MiniMax H3 助力复活中世纪短视频创作,工作流全公开 — zanatas · 2026-08-24
- NAPE 音频预训练法开源:无解码器 SOTA — kastnerkyle · 2026-08-24
- H3 模型生成复杂太空场景效果惊艳 — SIR_NVAX_A_LOT · 2026-08-24