OpenAI Cuts Realtime Voice Latency by 25% via Cache Optimization

OpenAIDevs · x · 2026-07-07

By improving its caching mechanism, OpenAI has reduced the p95 latency of its Realtime voice models by at least 25%.

Original post →

More from Infra

Infra channel →