Eleven v4 登顶 TTS 竞技场,支持 90+ 语言但定价是谷歌 5 倍
ArtificialAnlys · x · 2026-09-28
Artificial Analysis 发布 ElevenLabs 新一代语音合成模型 Eleven v4 的评测结果:
- Provider Voice 榜第一:Elo 1,319(1,674 次出场),领先 Cartesia Sonic 3.6(1,276)和 Google Gemini 3.8 Flash TTS(1,267),且在客服、助手、知识分享、娱乐四个分类全部第一。
- Controlled Voice 榜第二:Elo 1,157,仅次于阿里 Qwen-Audio-3.1-TTS-Plus(1,178),远超前代 v3(1,073)。
- 发音鲁棒性 91.7%:为其测得的历史最高分,超过 Gemini 3.8 Flash TTS(89.5%),较 v3(85.6%)明显提升。
- 语言支持从 70+ 扩至 90+ 种。
- 代价不菲:$80/1M 字符,而 Sonic 3.6 为 $49、Gemini 3.8 Flash TTS 仅 $16.49;速度 73.4 字符/秒(v3 为 42.5)。
所属事件:ElevenLabs Eleven v4 登顶 TTS 竞技场,支持 90+ 语言但价格偏高(5 条相关)→
「多模态」频道最新
- Midjourney 单词提示词系列第 7 期:一个古词出唯美大片 — tisch_eins · 2026-09-28
- 外部 LLM 先做设计决策再出图:Qwen Image 2.1 提示词模板实测 — wjc_5 · 2026-09-28
- 用一句 prompt 让 ChatGPT 产出杂志级时尚大片 — umesh_ai · 2026-09-28
- Synthesia 发布 Express-3 数字人模型:更快更清晰,全套餐可用 — synthesiaIO · 2026-09-28
- 阿里开源 Qwen-Image-2.1:仅 7B 参数,原生支持透明图输出 — thione · 2026-09-28
- AI 分镜难题:如何控制角色走位并保持场景跨镜头一致 — ghostman02 · 2026-09-28