Qwen3.8 Variants: 8-bit Model Cuts Memory by 27%

EyalToledano · x · 2026-08-28

Two MLX quantized variants based on Qwen3.8-Flash-Next-REAP have been released.

Original post →

More from Infra

Infra channel →