OpenAI 全双工语音模型 GPT-Live-1 登顶语音榜,可委托后端模型推理
ArtificialAnlys · x · 2026-09-15
OpenAI 发布全双工语音对语音模型 GPT-Live-1,在 Artificial Analysis 语音榜以 81.5 分位列第一,超过 Grok Voice Think Fast 2.0(81.3)。
核心特点与评测要点:
- 架构新颖:对话持续进行的同时,可把推理和工具调用委托给后端文本模型(Astra 或 Sol),开发者通过 API 流式输入音频、接收语音回复,后端模型单独配置。
- 代理性能:Tau Voice 基准上,GPT-Live-1(Astra)以 67.9% 居首,Grok 为 56.5%。
- 偏好与任务成功:Speech Agent Arena 中两个配置分列第 3、4 名(1053/1048 Elo),Grok 任务成功率最高(94.6%),Gemini 3.1 Flash Live Minimal 偏好分最高(1096 Elo)。
- 速度与成本:首个音频延迟约 1.24-1.34 秒(Grok 0.70 秒最快);综合成本每小时输入音频 $4.47-5.83,低于 GPT-Realtime-2.1 的 $10.75,略高于 Grok 的 $4.80。
所属事件:OpenAI 全双工语音模型 GPT-Live-1 登顶语音榜(4 条相关)→
「模型」频道最新
- OpenAI 研究员揭秘:实验室员工为何突然集体恐慌 — socoolandawesome · 2026-09-15
- 本地 Qwen 跑编码 agent 频繁跑偏,用户对比后认了 Claude Code — tlpta · 2026-09-15
- 曝某前沿实验室自 8 月 28 日起训练新模型,数学基准表现空前 — rapha_gl · 2026-09-15
- 用户吐槽 AI 道德审查过度:床上依偎合照也被拒生成 — MeroveeFrancSalien · 2026-09-15
- 为什么让 AI 提炼三条结论还要等十分钟:Prefill 与 Decode 机制解析 — dotey · 2026-09-15
- 爆料称 xAI 落后 OpenAI 与 Anthropic 约 6-12 个月 — sachinmaya1980 · 2026-09-15