Bland Speech v3发布:超越ElevenLabs等,助中风患者重获新声
LinusEkenstam · x · 2026-08-05
Bland 推出了全新的语音引擎 Speech v3,号称是全球首款人类语音引擎。该模型基于超过 1 亿段真实人类对话训练而成。
在 Design Arena 的 Audio Realism 基准测试中,Speech v3 的表现超越了 ElevenLabs、Grok、Cartesia 和 OpenAI 等主流模型,位列榜首。为了展示其强大的声音复刻能力,团队仅用 5 秒钟的旧视频素材,就帮助一位 49 岁近期中风失语的父亲 James 成功恢复了声音。
所属事件:Bland AI 发布 Speech v3 语音引擎(3 条相关)→
「多模态」频道最新
- 海螺H3高阶玩法:用结构化提示词精准控制视频细节 — socialwithaayan · 2026-08-05
- Hailuo H3 vs Seedance 2.0 实测:H3 画面更锐利,细节更丰富 — socialwithaayan · 2026-08-05
- ComfyUI-SAM3D-BodyMod 节点发布,支持体型调整与运镜 — petewoodbridge · 2026-08-05
- LucyLive v1.03 发布:Cinema 4D 实时 AI 渲染插件 — petewoodbridge · 2026-08-05
- LTX 2.3 新 Lora:为任意视频添加运镜效果 — CQDSN · 2026-08-05
- 字节 Seedance 2.5 上线:单次生成 30 秒,支持 50 个多模态参考素材 — ahuja_priyank · 2026-08-05