Bland 发布 Speech v3 语音引擎,实测超越 ElevenLabs 与 OpenAI
ycombinator · x · 2026-08-05
Bland 推出号称全球首个「人类语音引擎」的 Speech v3 模型。该模型基于超过 1 亿段真实人类对话训练而成,主要面向企业、开发者和创作者。
在 Design Arena 的音频真实感基准测试中,Speech v3 成绩位列第一,击败了 ElevenLabs、Grok、Cartesia 和 OpenAI 等主流模型。官方还展示了一个案例:仅用 5 秒的旧视频素材,就帮助一位因中风失声的 49 岁父亲恢复了声音。
所属事件:Bland AI 发布 Speech v3 语音真实度盲测登顶(2 条相关)→
「多模态」频道最新
- Seedance 误判频发,创作者呼吁 AI 公司停止过度审查 — TheChuckTone · 2026-08-05
- MiniMax H3 实测:结合 Krea 图像与 Gemini 提示词生成视频 — comfyui_user_999 · 2026-08-05
- Grok 4.5 结合 Blender MCP:用对话直接搭建 3D 场景 — elonmusk · 2026-08-05
- 单提示词生成1500+汽车零件:Opus模型硬核CAD实测 — mattshumer_ · 2026-08-05
- Grok Imagine Video 1.5 跃居图生视频榜眼 — elonmusk · 2026-08-05
- MiniMax H3 图生视频画质翻车?用户实测不如纯文生视频 — Naruwashi · 2026-08-05