Qwen 发布自定义语音 TTS 模型
Qwen · hf · 2026-07-19
Qwen 的 Qwen3-TTS-12Hz-1.7B-CustomVoice 在 Hugging Face 上进入趋势榜。
这是一个文本转语音模型,支持自定义声音(Custom Voice),参数规模为 1.7B。页面信息还显示其使用 safetensors、许可证为 Apache-2.0,并附有论文链接 arXiv:2601.15621。
「多模态」频道最新
- AI 电影节 Lumara 将登陆纽约,顶级 AI 电影人齐聚评审 — 0xAllen_ · 2026-09-11
- FLUX.2 Klein 换表情易丢脸,实测不如免费版 Gemini 保真 — wacomlover · 2026-09-11
- 腾讯 AuK 语音模型开源代码与权重上线 GitHub,附 ComfyUI 支持 — aigclink · 2026-09-11
- 用 Midjourney+Seedance 把龙神宿敌大战拍成 AI 电影短片 — azed_ai · 2026-09-11
- fable 5.1 用 25.6 万条 JS 笔画复刻《星月夜》 — cedric_chee · 2026-09-11
- GPT-6 Astra 接 Hyper3D MCP,一句话生成 3D 资产 — ahuja_priyank · 2026-09-11