Benchmarking Qwen 3.8 27B on RTX 4090: Q5 vs Q6 in 3D Code Generation

source-drifter · reddit · 2026-08-15

A user benchmarked Qwen 3.8 27B (Q5-xl and Q6-k) models on an RTX 4090 (24GB) for generating a Three.js 3D arena game. At 'xhigh' reasoning settings, the Q6 model took 3.5 hours to generate 84k tokens (6 t/s), while the Q5 model finished 57k tokens in 13 minutes (72 t/s). Although Qwen 3.8 outperforms version 3.6 in quality, the time and token cost are 3-4 times higher at maximum settings. At 'medium' reasoning, the Q5-xl offers better results in under 2 minutes.

Original post →

More from Models

Models channel →