Bland AI 发布 Speech v3,盲测语音真实度登顶
EXM7777 · x · 2026-08-05
Bland AI 推出了全新的文本转语音模型 Bland Speech v3,官方称其为首个“人类语音引擎”。
该模型基于超过 1 亿段真实人类对话训练而成。在第三方盲测榜单 Audio Realism Bench 中,Bland Speech v3 以 1237 的 Elo 评分位列第一,超越了 Grok TTS、GPT Realtime 2、Gemini 2.5 Pro TTS 以及 ElevenLabs 等主流模型。官方还展示了一个案例:仅用 5 秒钟的旧音频素材,就帮助一位中风失语的 49 岁父亲恢复了声音。
所属事件:Bland AI发布Speech v3,盲测真实度超越人类(4 条相关)→
「多模态」频道最新
- Qwen-Image-2.1 权重已在 Hugging Face 开放下载 — SamuelTallet · 2026-09-20
- 阿里 Qwen 发布 Qwen-Image-2.1 图像生成模型,官方博客上线 — StableLlama · 2026-09-20
- ComfyMax 音频分块器发布小幅更新 — DanielVeres · 2026-09-20
- 开发者用 Midjourney 与 Kling 复刻 80 年代诡异 VHS 广告推广自家游戏 — sevencavesinteractiv · 2026-09-20
- MiniMax H3 三步 LoRA 实测:生成提速近 4 倍,画质仍略逊 Fused Turbo — cgpixel23 · 2026-09-20
- 用 MiniMax H3 Max 重制 2 小时电影,成本已降到几千美元级 — bennash · 2026-09-20