Qwen-Image 2.1 开源:SGLang 首日支持,单卡 4090 跑 22.7GB 显存
ying11231 · x · 2026-09-21
阿里 Qwen 团队发布开源权重图像模型 Qwen-Image-2.1:7B 轻量架构,统一支持生成与编辑,宣称超越多数闭源模型;原生支持 RGBA 透明图层生成与编辑,可接受最多 10 张参考图并做精确局部编辑。SGLang-Diffusion 同步提供 day-0 支持:单张 RTX 4090 24GB 经 CPU offload 以原生精度运行,1024×1024 生成 18.7s、图像编辑 21.7s、峰值显存 22.7 GiB;RTX PRO 6000 96GB 上生成 8.0s、编辑 9.6s。支持 TP/SP、LoRA 与 OpenAI 兼容 API,40 步去噪、无量化。
所属事件:阿里开源 Qwen-Image-2.1,7B 统一生图与编辑(27 条相关)→
「Infra」频道最新
- 16 节点 GB10 集群跑满 2.8T 参数 Kimi K3:编码解码 30 tok/s — ciprianveg · 2026-09-21
- KDA/Mamba 长缓存复用踩坑:恢复长 prompt 触发非法内存访问 — TheZachMueller · 2026-09-21
- 量化模型上下文 128k 配压缩优于裸跑 256k/1M — Informal-Trouble2183 · 2026-09-21
- BNEF:2035 年美国数据中心天然气消耗将超德日总和 — Beth_Kindig · 2026-09-21
- RLinf 集成 SGLang 跑 Cosmos3,端到端评估吞吐提升 3.33 倍 — ying11231 · 2026-09-21
- Wafer 发布 AI 性能工程仓库:CUDA、FlashAttention 到量化全覆盖 — Hesamation · 2026-09-21