Qwen Audio Realtime Tested: Cost and Reasoning vs GPT Models
ArtificialAnlys · x · 2026-07-29
Artificial Analysis has released a new comparison of native Speech-to-Speech models. On the Big Bench Audio subset, Qwen Audio 3.0 Realtime Plus costs $4.42 per hour of input audio—slightly more expensive than GPT-Realtime-2 High ($4.14) but 2.4x cheaper than GPT-Realtime-2.1 High ($10.75).
Meanwhile, the Flash variant measures $4.77 per hour, appearing more costly than Plus on the benchmark. This is driven by comparatively more verbose responses: Flash generates an average of 2,043 total output tokens per response versus 1,232 for Plus.
Related event: Qwen Audio 3.0 Realtime Costs Slightly Higher Than GPT in Benchmark(2 posts)→
More from Models
- Dev Critiques Claude Opus: Brilliant but Lacks Rigor, Only Does What It Wants — heyneighbor · 2026-07-30
- OpenAI Says GPT-5.6 Sol Self-Optimizes: 20% Lower Serving Costs — OpenAI · 2026-07-30
- Opus 4.8 Emits 6x More Tokens Per Turn for Denser Deliberation — jyangballin · 2026-07-30
- Reverse Engineering Claude's Tokenizer: Quirks and Internal Mechanics Revealed — soldni · 2026-07-30
- Dev tests Kimi K3: Full reasoning traces offer a transparent edge — doodlestein · 2026-07-30
- Dev builds parallel verification swarms leveraging cheap, fast Grok model — rudrank · 2026-07-30