Eleven v4 登顶 TTS 发音基准,三类得分超 93%
ArtificialAnlys · x · 2026-09-28
Artificial Analysis 发布 Pronunciation Robustness 基准,衡量 TTS 模型对困难文本的发音准确度,覆盖四个类别,由人类评审按预先约定的标准发音逐条判定。
- 缩写展开:Eleven v4 以 94.1% 排名第一,领先 Gemini 3.8 Flash TTS 的 86.1%,较 Eleven v3 的 82.7% 明显提升
- 语境适配:Eleven v4 得分 94.1%,低于 Gemini 3.8 Flash TTS 的 97.9%
- 独立术语:Eleven v4 得 93.2%,Eleven v3 Conversational 以 95.1% 领先
- 精确序列保留:Eleven v4 得 78.8%(v3 为 71.2%),SpaceXAI TTS 以 85.7% 居首
Eleven v4 是唯一在四个类别中三个都超过 93% 的模型。
「多模态」频道最新
- Midjourney 单词提示词系列第 7 期:一个古词出唯美大片 — tisch_eins · 2026-09-28
- 外部 LLM 先做设计决策再出图:Qwen Image 2.1 提示词模板实测 — wjc_5 · 2026-09-28
- 用一句 prompt 让 ChatGPT 产出杂志级时尚大片 — umesh_ai · 2026-09-28
- Synthesia 发布 Express-3 数字人模型:更快更清晰,全套餐可用 — synthesiaIO · 2026-09-28
- 阿里开源 Qwen-Image-2.1:仅 7B 参数,原生支持透明图输出 — thione · 2026-09-28
- AI 分镜难题:如何控制角色走位并保持场景跨镜头一致 — ghostman02 · 2026-09-28