OpenAI 推出两款语音转写模型,实时场景更低延迟

OpenAIDevs · x · 2026-07-29

OpenAI 在 API 里推出了两款新的转写模型:

官方强调这两款模型更能利用上下文,在带口音和多语言的真实音频上更准。OpenAI 还给出了上下文敏感 ASR 基准:在不提供自由文本上下文时,GPT-Live-Transcribe 的语义准确率是 38.5%,加入上下文后升到 44.6%。

另外两组结果是:

OpenAI 还建议在实时转写里提供录音背景、专有名词关键词、预期输入语言,以及前文转写片段作为上下文。

所属事件:OpenAI 发布两款语音转写新模型,性能提升且价格大降(15 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →