Bland 发布 Speech v3 语音引擎,实测超越 ElevenLabs 与 OpenAI
ycombinator · x · 2026-08-05
Bland 推出号称全球首个「人类语音引擎」的 Speech v3 模型。该模型基于超过 1 亿段真实人类对话训练而成,主要面向企业、开发者和创作者。
在 Design Arena 的音频真实感基准测试中,Speech v3 成绩位列第一,击败了 ElevenLabs、Grok、Cartesia 和 OpenAI 等主流模型。官方还展示了一个案例:仅用 5 秒的旧视频素材,就帮助一位因中风失声的 49 岁父亲恢复了声音。
所属事件:Bland AI发布Speech v3,盲测真实度超越人类(4 条相关)→
「多模态」频道最新
- GPT Image 手工微缩景观提示词模板,一键生成城市立体书画面 — SimplyAnnisa · 2026-09-06
- 用户实测:Astra 出图比 Sol 更忠实执行提示词,Grok 体验最差 — Linahuaa · 2026-09-06
- 博主分享一条梦境风格图像生成提示词 — umesh_ai · 2026-09-06
- Codex 一句「写首协奏曲」,5 分钟产出乐谱、动画与真实乐器音轨 — mhmazur · 2026-09-06
- 用 MiniMax + ComfyUI 给老电影加新场景,角色声音一致性仍是难点 — StudentLeather9735 · 2026-09-06
- 单色高调人像摄影 Prompt 分享:黑白极简剪影风 — azed_ai · 2026-09-06