第三方实测:AssemblyAI Universal 3.5 Pro 语音转写准确率延迟双冠
AssemblyAI · x · 2026-09-24
第三方基准 Converse-STT(Cekura Bench)对 15 个语音转文字模型做了同口径实测,AssemblyAI Universal 3.5 Pro 在准确率和延迟上双双第一。
- 在 1000 条 Pipecat FLEURS 朗读音频上,词错率最低,仅 1.93%,优于 Google Chirp 3(2.00%)、Resonate(Reson8, 2.10%)、GPT Realtime Whisper(2.16%)等。
- 中位首字延迟(TTFT P50)仅 489ms,是所有受测模型中最快开始返回转写的;Google Chirp 3 同指标高达 4.48 秒。
- 综合来看,Universal 3.5 Pro 处于质量-速度帕累托前沿,适合对实时性敏感的语音 agent 场景。
完整结果可在 Cekura Bench 公开页面查看,测试源代码也已开源。
「模型」频道最新
- BFL 视频模型与 Minimax H3 权重迟迟未开源,社区追问 FAL 去向 — krigeta1 · 2026-09-24
- 用户实测:Opus 5.5 音频感知极强,会用频谱图处理声音 — repligate · 2026-09-24
- GPT-6 Astra 实机通关《求生之路2》:75 秒首轮 Dead Center — imjustnewatai · 2026-09-24
- 同一提示词 GPT-3.5 全说漏,GPT-4 却 30/30 返回空响应 — rayanpal_ · 2026-09-24
- Box 实测 Opus 5.5:token 省 63%,速度提升 30% 且更便宜 — bcherny · 2026-09-24
- Claude Opus 5.5 Max 登顶 Code Arena,领先 GPT-6 Astra 26 分 — airesearch12 · 2026-09-24