GPT-Live τ-Voice 成绩相差 20 个百分点,后端模型影响巨大
rdesh26 · x · 2026-09-12
作者质疑 GPT-Live 的多个 τ-Voice 成绩:OpenAI 博客 86.2%、官方排行榜 81.7%、Artificial Analysis 仅 67.9%。随机性只能解释一部分,20 个百分点的差距与后端模型选择关系很大(对比 Astra 与 Sol 的差异)。作者推荐阅读 OpenAI 公开的 CRAWL/WALK/RUN 语音 agent 评测工具。属于 GPT-Live-1 解析线程的一部分。
「模型」频道最新
- DeepSeek v4.1 Flash 发布首日即适配 vLLM,覆盖六款 NVIDIA GPU — woosuk_k · 2026-09-12
- ARC-AGI 成本 18 个月暴跌 20 万倍:DeepSeek 达 o3 水平仅 2 美分 — inductionheads · 2026-09-12
- 开源无审查 AI 有需求,分发渠道却停滞两年 — Rumbleblak · 2026-09-12
- DSV4.1 把全局 KV 压到 890 字节,HBM 需求争论再起 — teortaxesTex · 2026-09-12
- Claude 用户吐槽用量限额混乱:解锁时间与 5 小时重置互相矛盾 — XCxBigDong69XCx · 2026-09-12
- SGLang 深度适配 DeepSeek V4.1 Flash,24 小时内冲到 873 tok/s — BanghuaZ · 2026-09-12