Qwen3.8 27B xhigh burns 23.8K tokens overthinking a simple card prompt — and crushes every rival

hiImMate · reddit · 2026-08-18

A user tested Qwen3.8 27B (UDQ4XL quant) thinking-effort tiers against DS V4 Flash, ChatGPT, and Claude Opus 5, using an open-ended prompt to write an HTML card about apple benefits.

Takeaway: xhigh can get into a long thinking match even on simple prompts but delivers notably better output; with concrete prompts, medium cuts tokens/time heavily while staying strong — good for low-tps setups.

Related event: Qwen 3.8 27B's heavy reasoning tokens spark debate, users defend depth over speed(7 posts)→

Original post →

More from Models

Models channel →