GPT-Transcribe halves Whisper’s error rate on real-world audio benchmarks
OpenAIDevs · x · 2026-07-29
OpenAI shared benchmark results for GPT-Transcribe:
- On Context Aware ASR, semantic accuracy improved from 41.6% without free-form context to 45.2% with context.
- On Common Voice across 22 languages, it reached a 19.27% transcription error rate, versus 40.37% for Whisper (whisper-1).
- On Real-World Audio Recording across 9 languages, it reached an 8.98% error rate, versus 15.21% for Whisper (whisper-1).
More from Models
- Weird Model Behavior: Opus 5 Loves Saying 'Sabotage Test' — emax · 2026-07-30
- Engineer Debunks Kimi K3 Memory Claims: Small State ≠ Flash Offload — AccBalanced · 2026-07-30
- Dev Critiques Claude Opus: Brilliant but Lacks Rigor, Only Does What It Wants — heyneighbor · 2026-07-30
- OpenAI: GPT-5.6 Fuses Frontier Intelligence with Efficiency — Outside-Iron-8242 · 2026-07-30
- OpenAI Says GPT-5.6 Sol Self-Optimizes: 20% Lower Serving Costs — OpenAI · 2026-07-30
- Opus 4.8 Emits 6x More Tokens Per Turn for Denser Deliberation — jyangballin · 2026-07-30