Qwen3.8-Flash-Next released in 1-4bit GGUF formats

MaziyarPanahi · x · 2026-08-27

UnslothAI has released GGUF quantized versions of Qwen3.8-Flash-Next, ranging from 1-bit to 4-bit precision. The author suggests using llama.cpp to run these models.

Related event: Qwen3.8-Flash Runs Locally in 75GB, GGUF Quantized Versions Released(2 posts)→

Original post →

More from Models

Models channel →