GPT-Live-1 语音推理细节:Tau Voice 领跑,音频推理仍逊于 Grok
ArtificialAnlys · x · 2026-09-15
评测细节:GPT-Live-1 (Astra, medium) 以 67.9% 领跑 Tau Voice 代理基准,(Sol, low) 59.3%,Grok 56.5%,这是其总榜登顶的主要驱动。但在 Big Bench Audio 语音推理上,两款配置分别 90.1%、89.0%,落后 Grok 的 97.2%。Full Duplex Bench 子集上则达到 94.9% 和 97.3%。两个配置目前均为单次试验结果。
所属事件:OpenAI 全双工语音模型 GPT-Live-1 登顶语音榜(4 条相关)→
「模型」频道最新
- OpenAI 研究员揭秘:实验室员工为何突然集体恐慌 — socoolandawesome · 2026-09-15
- 本地 Qwen 跑编码 agent 频繁跑偏,用户对比后认了 Claude Code — tlpta · 2026-09-15
- 曝某前沿实验室自 8 月 28 日起训练新模型,数学基准表现空前 — rapha_gl · 2026-09-15
- 用户吐槽 AI 道德审查过度:床上依偎合照也被拒生成 — MeroveeFrancSalien · 2026-09-15
- 为什么让 AI 提炼三条结论还要等十分钟:Prefill 与 Decode 机制解析 — dotey · 2026-09-15
- 爆料称 xAI 落后 OpenAI 与 Anthropic 约 6-12 个月 — sachinmaya1980 · 2026-09-15