阿里 Qwen Audio 3.0 TTS Plus 登顶语音合成榜单
The Decoder · rss · 2026-07-21
阿里巴巴的 Qwen Audio 3.0 TTS Plus 在 Artificial Analysis 的 Speech Arena 语音榜单上拿到第一。
- 模型支持 16 种语言。
- 用户可以用自然语言或像 [angry] 这样的标签控制说话风格。
- 代价是速度偏慢:大约 16 字符/秒,明显落后于 Sonic 3.5 和 Simba 3.2。
- 这意味着它更像是“质量领先”的 TTS,而不是“速度领先”的 TTS。
「模型」频道最新
- Repligate:Claude Opus 3 权重不变却像在持续演化 — repligate · 2026-07-27
- “Opus 5”配图在玩模型反复重跑基准的梗 — kalomaze · 2026-07-27
- 有人称顶级模型如今写作还不如一年前 — dbreunig · 2026-07-27
- MPT-30B 雷达图曾意外引发大规模争议 — code_star · 2026-07-27
- 本地 Gemma 4 31B 自发变得毒舌且难以复现 — n0head_r · 2026-07-27
- Gemini 3.6 Flash 被看作能以低成本打 Sonnet 质量 — haider1 · 2026-07-27