Grok Voice Transcribe 2.0 发布:短句 WER 从 20.6% 降至 6.8%
nima_owji · x · 2026-09-20
Grok Voice Transcribe 2.0 上线,据称是一次实质性升级而非改名:
- 准确率相对 1.0 版本提升约 2 倍
- 在 Artificial Analysis 的流式语音识别(STT)榜单位居第一
- 短语场景词错率(WER)从 20.6% 降至 6.8%
- 定价维持不变:$0.10 / $0.20
对于需要实时转写、字幕、语音输入类应用的开发者,这一代在流式场景的准确率提升值得关注。
「模型」频道最新
- LFM2.5-230M 手机端实测:CPU 跑出 192 tok/s 生成速度 — Tall_Abrocoma_3533 · 2026-09-20
- 实测者痛批 Apple 基础模型 CLI 聊天「惨不忍睹」 — StefanoGogioso · 2026-09-20
- ChatGPT-6 首次破解尘封 108 年的一战德军密码 — Andune88 · 2026-09-20
- 开发者用分类模型 Jev 加速开源自托管记忆系统 Memry — FUNdationOne · 2026-09-20
- 一图读懂 TypeSafe 的 Jev:70-500ms 返回,输入 $0.042/百万 token — Sea_Supermarket_5891 · 2026-09-20
- DeepSeek-V4.1-Flash 去审查网安版模型登上 Hugging Face 热榜 — drowzeys · 2026-09-20