Bland AI 发布 Speech v3,盲测语音真实度登顶
EXM7777 · x · 2026-08-05
Bland AI 推出了全新的文本转语音模型 Bland Speech v3,官方称其为首个“人类语音引擎”。
该模型基于超过 1 亿段真实人类对话训练而成。在第三方盲测榜单 Audio Realism Bench 中,Bland Speech v3 以 1237 的 Elo 评分位列第一,超越了 Grok TTS、GPT Realtime 2、Gemini 2.5 Pro TTS 以及 ElevenLabs 等主流模型。官方还展示了一个案例:仅用 5 秒钟的旧音频素材,就帮助一位中风失语的 49 岁父亲恢复了声音。
所属事件:Bland AI发布Speech v3,盲测真实度超越人类(4 条相关)→
「多模态」频道最新
- 用 MiniMax + ComfyUI 给老电影加新场景,角色声音一致性仍是难点 — StudentLeather9735 · 2026-09-06
- 单色高调人像摄影 Prompt 分享:黑白极简剪影风 — azed_ai · 2026-09-06
- 导演丹尼·博伊尔用 AI 只做 30 秒镜头,划出使用边界 — taherdhanera · 2026-09-06
- Google WeatherNext 3 弃物理模拟,直接学卫星数据做预报 — The Decoder · 2026-09-06
- DiSReg 新 LoRA 训练法:用自正则化消除触发词外的标签污染 — bdsqlsz · 2026-09-06
- MiniMax 推 H3 Max Director:实时可控视频流,每秒最低 0.02 美元 — isidentical · 2026-09-06