GPT-Live τ-Voice 成绩相差 20 个百分点,后端模型影响巨大

rdesh26 · x · 2026-09-12

作者质疑 GPT-Live 的多个 τ-Voice 成绩:OpenAI 博客 86.2%、官方排行榜 81.7%、Artificial Analysis 仅 67.9%。随机性只能解释一部分,20 个百分点的差距与后端模型选择关系很大(对比 Astra 与 Sol 的差异)。作者推荐阅读 OpenAI 公开的 CRAWL/WALK/RUN 语音 agent 评测工具。属于 GPT-Live-1 解析线程的一部分。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →