Bland 发布 Speech v3 语音引擎,实测超越 ElevenLabs 与 OpenAI
ycombinator · x · 2026-08-05
Bland 推出号称全球首个「人类语音引擎」的 Speech v3 模型。该模型基于超过 1 亿段真实人类对话训练而成,主要面向企业、开发者和创作者。
在 Design Arena 的音频真实感基准测试中,Speech v3 成绩位列第一,击败了 ElevenLabs、Grok、Cartesia 和 OpenAI 等主流模型。官方还展示了一个案例:仅用 5 秒的旧视频素材,就帮助一位因中风失声的 49 岁父亲恢复了声音。
所属事件:Bland AI发布Speech v3,盲测真实度超越人类(4 条相关)→
「多模态」频道最新
- 开源 AudioSlopServer:单卡托管多个音频扩散模型 — SteveLittleFish · 2026-09-20
- AI 自动生成剧集:「下一集」按钮让模型不停产出新内容 — Kyrannio · 2026-09-20
- NoSpoon 微短剧 agent 接入 Grok Imagine,一键生成剧集海报 — Kyrannio · 2026-09-20
- MiniMax H3 生成「龙穴」视频,画质惊艳引 Reddit 热议 — apoke890 · 2026-09-20
- Runway 欲借世界模型 GWM-1 把 AI 视频做成可实时控制的直播流 — The Decoder · 2026-09-20
- AI 生成连续剧《Omniverse》更新第五集,全程视频模型制作 — zlausd · 2026-09-20