Bland Speech v3发布:超越ElevenLabs等,助中风患者重获新声
LinusEkenstam · x · 2026-08-05
Bland 推出了全新的语音引擎 Speech v3,号称是全球首款人类语音引擎。该模型基于超过 1 亿段真实人类对话训练而成。
在 Design Arena 的 Audio Realism 基准测试中,Speech v3 的表现超越了 ElevenLabs、Grok、Cartesia 和 OpenAI 等主流模型,位列榜首。为了展示其强大的声音复刻能力,团队仅用 5 秒钟的旧视频素材,就帮助一位 49 岁近期中风失语的父亲 James 成功恢复了声音。
所属事件:Bland AI发布Speech v3,盲测真实度超越人类(4 条相关)→
「多模态」频道最新
- Qwen-Image-2.1 权重已在 Hugging Face 开放下载 — SamuelTallet · 2026-09-20
- 阿里 Qwen 发布 Qwen-Image-2.1 图像生成模型,官方博客上线 — StableLlama · 2026-09-20
- ComfyMax 音频分块器发布小幅更新 — DanielVeres · 2026-09-20
- 开发者用 Midjourney 与 Kling 复刻 80 年代诡异 VHS 广告推广自家游戏 — sevencavesinteractiv · 2026-09-20
- MiniMax H3 三步 LoRA 实测:生成提速近 4 倍,画质仍略逊 Fused Turbo — cgpixel23 · 2026-09-20
- 用 MiniMax H3 Max 重制 2 小时电影,成本已降到几千美元级 — bennash · 2026-09-20