Bland Speech v3发布:超越ElevenLabs等,助中风患者重获新声

LinusEkenstam · x · 2026-08-05

Bland 推出了全新的语音引擎 Speech v3,号称是全球首款人类语音引擎。该模型基于超过 1 亿段真实人类对话训练而成。

在 Design Arena 的 Audio Realism 基准测试中,Speech v3 的表现超越了 ElevenLabs、Grok、Cartesia 和 OpenAI 等主流模型,位列榜首。为了展示其强大的声音复刻能力,团队仅用 5 秒钟的旧视频素材,就帮助一位 49 岁近期中风失语的父亲 James 成功恢复了声音。

所属事件:Bland AI 发布 Speech v3 语音引擎(3 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →