Sesame 开源 TurnBench:评测语音 AI 的对话时机把握
realmrfakename · x · 2026-08-29
Sesame 发布开源基准 TurnBench,专门评测语音 AI 的「轮转时机」(turn-taking)能力:模型能否判断说话人是否真的说完了、"mm-hmm" 是附和还是打断。
- 人类对话轮转间隙仅约 200 毫秒,短于规划一个词所需的约 600 毫秒,说明听者是在预测对方何时结束,而非单纯等待沉默。
- 打断、抢话、尴尬沉默是当前语音 AI 的通病,也是「一听就是机器」的关键破绽。
- TurnBench 复用 Sesame 内部评测体系(同套分类、任务与打分协议),提供公开排行榜、交互式对话查看器和 dev 集自助打分,与 CMU、Mundo AI 等合作构建。
「模型」频道最新
- Unsloth 推出 GLM-5.3 GGUF 版本,支持本地部署 — burny_tech · 2026-08-29
- GLM-5.3-Flash 现场编写汽车博物馆 Blender 脚本 — mishig25 · 2026-08-29
- Polymarket 预测:年底前发布 Grok 5 几率达 69% — Polymarket · 2026-08-29
- GLM-5.3 全量版将开源,引发生态权益讨论 — examachine · 2026-08-29
- Perplexity 集成 GLM 5.3,长上下文推理超上代 — perplexity_ai · 2026-08-29
- 开发者实测:Kimi K3 内核任务优于 Claude 5.6 — YouJiacheng · 2026-08-29