OpenAI 发布 GPT-Live-1 语音 Agent 基准:聚焦任务完成与插话响应
OpenAIDevs · x · 2026-09-11
OpenAI 开发者账号发布 GPT-Live-1 在语音 Agent 生产场景下的基准表现,评测维度包括:任务完成率、双向对话与话轮切换、响应速度以及工具调用能力。官方公布了完整结果数据,面向生产环境的语音 Agent 开发者提供参考。
所属事件:OpenAI 语音模型 GPT-Live-1 上线 API(22 条相关)→
「模型」频道最新
- 微软月度补丁修复 974 个漏洞,多数由 AI 系统发现 — Distinct-Question-16 · 2026-09-11
- DeepSeek V4.1 登顶 Vals 开源模型榜,每次测试仅 0.3 美元 — teortaxesTex · 2026-09-11
- 日常编码真需要旗舰模型吗?开发者和 80% 时间用中等档位 — iamaliveix · 2026-09-11
- OpenAI 平台疑似上线托管 Agents 功能:环境、模板、会话已可创建 — testingcatalog · 2026-09-11
- 30B 开源模型 OpenResearcher 在 BrowseComp-Plus 超 GPT-4.1 — TheZachMueller · 2026-09-11
- Surge 评测四大新模型:Fable 5.1 综合第一得 68.7 分 — echen · 2026-09-11