Unsloth 量化让 Qwen-Image-2.1 仅需 6GB 显存本地运行
danielhanchen · x · 2026-09-23
Unsloth 发布 Qwen-Image-2.1 的 Dynamic GGUF 量化版本,宣称 7B 模型性能对标 Nano Banana 2.0,12GB 显存即可本地生图。
- 支持 INT8/FP8 与 GGUF 量化,配合内存 offloading,INT8/FP8 可在 6-8GB 显存内运行且速度尚可
- GGUF 只含去噪器,需搭配 VAE(bf16)与 Qwen3-VL-8B 文本编码器;实测 UD-Q4KXL 编码器相比 Q4KM 的 LPIPS 0.029、SSIM 0.959,体积 5.15GB、单张 36.5 秒
- 可用 Unsloth Desktop 或 stable-diffusion.cpp 运行,模型卡附完整 sd-cli 命令示例(1024x1024、20 步、cfg 6.0、euler 采样)
- Qwen-Image-2.1 本体为统一文生图与图像编辑模型,视觉生成部分 7B 参数、32 层 Single-Stream DiT
所属事件:Unsloth 量化的 Qwen-Image-2.1 支持 6GB 显存本地生图(2 条相关)→
「Infra」频道最新
- 421M 参数 Laya 模型经 OpenVINO INT8 量化后纯 CPU 玩 Flappy Bird — simpleuserhere · 2026-09-23
- 16GB 显存跑 Qwen3.8-27B 上 160k 上下文,全套配置公开 — According_Study_162 · 2026-09-23
- MLX-Serve 发布 v26.95:Qwen-Image 2.1 上 Mac,四路并发提速近一倍 — TheMoonMidas · 2026-09-23
- DigitalOcean Managed Agents 公测:闲置即暂停,接 75+ 模型 — HeyAmit_ · 2026-09-23
- 换掉最终决策层:Qwen+SGLang 比 Jev 快 37% 且精度相当 — VeryWellVersed · 2026-09-23
- Reka EdgeQ 端侧 VLM 登陆骁龙 8 Elite,首 token 仅 0.73 秒 — RekaAILabs · 2026-09-23