TTS 分项成绩:精确序列类差距最大,模型间从 5.3% 到 85.7%
ArtificialAnlys · x · 2026-09-22
Artificial Analysis 公布发音鲁棒性基准分项结果:Gemini 3.1 Flash TTS 在语境相关读音(96.4%)和缩写展开(84.4%)领先,后者仅比 SpaceXAI TTS 高 0.1 个百分点;SpaceXAI TTS 以 85.7% 领跑精确序列,领先 Realtime TTS-2(79.9%)5.8 个百分点;Qwen-Audio-3.0-TTS-Plus 在独立术语领先(95.5%)。模型间差距最大的是精确序列类,从 5.3% 到 85.7%。
所属事件:Artificial Analysis 发布 TTS 发音鲁棒性基准(6 条相关)→
「多模态」频道最新
- 用 Sentinel 可视化人类运动轨迹,效果惊艳 — Kyrannio · 2026-09-22
- 用户实测新版 Pika:质量漂亮,老牌玩家重回赛场 — Kyrannio · 2026-09-22
- 腾讯混元图像 3.5 登陆 OnSolo:5 张参考图 2K 输出仅 1 积分 — Div_pradeep · 2026-09-22
- AI 生图「博物馆雕像被调包」梗图走红,作者附上 prompt — umesh_ai · 2026-09-22
- 普林斯顿 VideoGen-Agent:多任务智能体 RL 调工具,视频生成提 19 分 — princetonu · 2026-09-22
- Intel 为 Qwen-Image-2.1 提供首日 OpenVINO 优化支持 — Alibaba_Qwen · 2026-09-22