Artificial Analysis 发布 TTS 语音生成对比榜,含发音鲁棒性基准
ArtificialAnlys · x · 2026-09-24
Artificial Analysis 推出文本转语音(TTS)模型横评页面,覆盖 95 个模型中的 27 个,可按质量、速度和价格对比各家的原生语音模型,数据来自其 Speech Arena 的用户偏好投票(Arena Elo)。
同时发布新的发音鲁棒性基准(Pronunciation Robustness Benchmark):由人工评审判断模型对英文片段的发音正确率,分为四类场景——
- 独立术语:品牌、地名、技术名词(如 Arkansas、façade);
- 语境消歧:拼写相同但语境不同读法不同(如 a w…);
- 缩写展开等其他类别。
每个模型用单一语音测试,提示词原样发送不做归一化,若模型提供文本归一化设置则用默认值。
所属事件:Artificial Analysis 发 TTS 发音鲁棒性榜,Gemini 3.8 Flash 登顶(12 条相关)→
「模型」频道最新
- ChatGPT 语音接入插件并由 GPT-6 驱动,可语音操作办公全流程 — Dimillian · 2026-09-24
- 爆料讨论:某前沿模型比 Astra 领先 8 个月、仅超前趋势 2 个月 — scaling01 · 2026-09-24
- Navier-Stokes 证明耗 1300 亿输出 token,OpenAI 重度用户日均仅数十亿 — scaling01 · 2026-09-24
- Meta Muse 4 万评分达 4.88:产品、分发、价格三线碾压式竞争 — RihardJarc · 2026-09-24
- 重跑 Audi 3D 建模对比:只有 GPT-6 Astra 与 Opus 5.5 能打 — kevinkern · 2026-09-24
- 自建 200 题校准测试:模型自报 90% 把关可信度 — colinmcnamara · 2026-09-24