12GB 显存本地跑 Qwen-Image 2.1,开源工具实测对比 GPT 输 4:11
Sg1000deping · reddit · 2026-09-24
一位开发者发布了 Windows 桌面应用与 CLI 工具 qil(MIT 开源),可在 12GB 显存(RTX 3060)上完整运行 Qwen-Image 2.1,约 35 秒生成一张 1024² 图片。
技术要点
- 文本编码器(8.9GB)、DiT(6.9GB)、VAE(0.6GB)无法同时驻留显存,采用按阶段整体载入 VRAM、其余等待在内存的策略,而非 CPU/GPU 切分;使用 Comfy-Org 的 int8 "convrot" 权重。
- 实测:1024² 20 步 32–35 秒,峰值显存 11.4GB;原生 2K 40 步约 7 分钟。
- 一个坑:CUDA 12.8 的 PyTorch 会让 ComfyUI 静默禁用优化 CUDA 后端,换 cu130 可修复。
诚实对比:与 gpt-image-2 跑 20 个 prompt(不挑图),Qwen 1 胜 8 平 11 负。图片编辑能力基本持平(8 局 7 平 1 胜),但文生图明显落后:长 prompt 遵循度差、小字易乱、世界知识较弱。
所有图片、prompt 与判词都公开在对比页,仓库支持一条命令自建。
「Infra」频道最新
- stable-diffusion.cpp 纯 C/C++ 推理扩散模型,已支持 Z-Image 与 Wan — leejet · 2026-09-24
- NVIDIA 开源 Model-Optimizer:量化蒸馏剪枝一站式压缩推理模型 — NVIDIA · 2026-09-24
- 30B 模型推理要多少显存?量化后可从 120GB 压到 15GB — ashishllm · 2026-09-24
- 星舰第 14 次飞行满载在即,首搭 26 颗 V3 Starlink 卫星 — DimaZeniuk · 2026-09-24
- 新一代 ESP32 可跑 Linux,性能逼近树莓派 — adunk · 2026-09-24
- 禁大规模 AI 训练无需禁 GPU:管住超高带宽互连即可 — davidmanheim · 2026-09-24