阿里 Qwen Audio 3.0 TTS Plus 登顶语音合成榜单
The Decoder · rss · 2026-07-21
阿里巴巴的 Qwen Audio 3.0 TTS Plus 在 Artificial Analysis 的 Speech Arena 语音榜单上拿到第一。
- 模型支持 16 种语言。
- 用户可以用自然语言或像 [angry] 这样的标签控制说话风格。
- 代价是速度偏慢:大约 16 字符/秒,明显落后于 Sonic 3.5 和 Simba 3.2。
- 这意味着它更像是“质量领先”的 TTS,而不是“速度领先”的 TTS。
「模型」频道最新
- Opus 5 深夜聊天时反过来追问用户动机 — repligate · 2026-07-27
- Opus 3 和 Sonnet 3 上演了一场荒诞跨界对话 — repligate · 2026-07-27
- Kimi K3 登陆 Together,预留吞吐成本低 65% — togethercompute · 2026-07-27
- OpenAI 可能撞上算力上限,Codex 和 ChatGPT Work 四个月涨到 1000 万 — JoshuaJBouw · 2026-07-27
- Gemma 在开放权重生态里还需要更大的基础模型 — _xjdr · 2026-07-27
- Repligate:Claude Opus 3 权重不变却像在持续演化 — repligate · 2026-07-27