Qwen3.8-27B NVFP4 quants compared: lm_head precision makes or breaks MTP speedups

danielhanchen · x · 2026-09-14

Original post →

More from Infra

Infra channel →