Cartesia 新语音模型家族获赞:WER 之外提出语境正确性评测思路
buckymoore · x · 2026-09-16
语音 AI 公司 Cartesia 介绍如何对语音模型做基准评测:生成音频后用语音识别(ASR)模型转写,再与原文对比计算词错误率(WER)。但他们指出 WER 只能判断模型是否说对了词——同一句话可能每个词都对,放在语境里却是错的。
buckymoore 转引该内容并称赞 Cartesia 最新模型家族的质量,同时提问:还有其他实验室在用另类架构做出这种规模的结果吗?
「模型」频道最新
- 中国开源模型占 OpenRouter 53% tokens?研究者称数据误导 — ohlennart · 2026-09-16
- 模型研发怪圈:小众场景终会被通用能力吞并 — samiramanabi · 2026-09-16
- 爆料称 Google 正打造数学特化版 DeepThink,原始思维链颇为有趣 — PMinervini · 2026-09-16
- 玩家称在《辐射3》中发现 OpenAI GPT-6 Astra 彩蛋 — imjustnewatai · 2026-09-16
- 观点:模型提速 5 倍无感,20-50 倍才会改变工作方式 — gabriel1 · 2026-09-16
- 博主预测重磅一周:Opus 5.2、Codex Bot 与降价版 Sol 将齐发 — daniel_mac8 · 2026-09-16