Bland AI 发布 Speech v3,盲测语音真实度登顶
EXM7777 · x · 2026-08-05
Bland AI 推出了全新的文本转语音模型 Bland Speech v3,官方称其为首个“人类语音引擎”。
该模型基于超过 1 亿段真实人类对话训练而成。在第三方盲测榜单 Audio Realism Bench 中,Bland Speech v3 以 1237 的 Elo 评分位列第一,超越了 Grok TTS、GPT Realtime 2、Gemini 2.5 Pro TTS 以及 ElevenLabs 等主流模型。官方还展示了一个案例:仅用 5 秒钟的旧音频素材,就帮助一位中风失语的 49 岁父亲恢复了声音。
「多模态」频道最新
- 开发者用 GPT-5.6 结合 Three.js 打造 3D 海岸灯塔 — techartist_ · 2026-08-05
- Krea 发布 FLUX 3:首增动作预测,支持与现实世界交互 — angrypenguinPNG · 2026-08-05
- AI 生成短片:便利店后门抽烟场景(第5集) — Stunning_Act_1530 · 2026-08-05
- AI 生成短片:魔法、斗篷与匕首(第4集) — Juponce · 2026-08-05
- Black Forest Labs 发布 FLUX 3:一个多模态模型 — stephen370 · 2026-08-05
- MiniMax H3 视频生成实测:自然语言提示效果惊艳 — ForestoShen · 2026-08-05