Developer Fits Qwen3.8-Flash-Next into 48GB MacBook
Developer Eyal Toledano used pruning and lookup-table techniques to run Qwen3.8-Flash-Next in 39GB of memory via Q4 quantization on MLX, later clarifying that the 28 tok/s speed applies to high-bandwidth machines like the M4 Max, not the MacBook Air.
2026-08-27 ~ 2026-08-28 · 2 related posts
- Episode 1: Pruned Qwen3 180B MoE Runs on Laptop with 65GB Footprint(2026-08-27, 2 posts)
- Episode 2: Developer Fits Qwen3.8-Flash-Next into 48GB MacBook(2026-08-27, 2 posts)
- Qwen3.8-Flash-Next Fits on a 48GB MacBook: Pruning + SSD N-gram Table, 39GB RAM — EyalToledano · 2026-08-27
- Two tricks squeeze Qwen3.8-Flash-Next onto a 48GB MacBook Air — EyalToledano · 2026-08-28