Qwen3 180B 模型剪枝后可在笔记本运行
开发者对 Qwen3.8-Flash-Next(180B 级 MoE)进行专家剪枝实测:采用 REAP 方法剪掉 25% 专家(REAP-384)后,显存/内存占用从约 97GB 降至 65GB 左右;再结合 NVMe offload(PLE)与 mmap 优化,可在单张 48GB 显卡乃至笔记本上运行该级别大模型,大幅降低部署门槛。
2026-08-27 ~ 2026-08-27 · 2 条相关
- 第 1 集:Qwen3 180B 模型剪枝后可在笔记本运行(2026-08-27,2 条)
- 第 2 集:开发者用剪枝加查表把大模型塞进 48GB MacBook(2026-08-27,2 条)
- Qwen3 MoE 剪枝实测:180B 级模型压到 65GB 可跑笔记本 — EyalToledano · 2026-08-27
- 72GB 显存跑 180B 模型?offload+剪枝实测 — EyalToledano · 2026-08-27