Qwen-Image-2.1 抢先实测:开源编辑新标杆,支持 10 张参考与原生透明图
listopalafoto · reddit · 2026-09-20
获得早期访问的作者实测 Qwen-Image-2.1,评价为「开源模型的新标杆」:
- 编辑精准,如「把马变蓝、羊变黑、裙子变白」这类指令执行到位
- 支持 10 张参考图,人物与 IP 角色识别一致
- 像素级精确的 2K 输出,文字渲染接近闭源模型水平
- 原生透明 PNG 生成:作者分享了 prompt 句式——开头写 "This is an RGBA image with transparency"、结尾写 "The image has alpha channel and the background is transparent"
- 支持局部 mask 编辑,基于 Qwen3VL-8b 可理解复杂长 prompt
- 面部表情与情绪渲染完整,可做深景深全画面合焦
不足:高对比度场景黑位过深、肤色红色略过饱和(约需减 10%),均可通过 ComfyUI 工作流修正。所有图用 ModelScope API 生成。
「多模态」频道最新
- Qwen Image 2.1 开源权重上线,但采用非商用研究许可 — julianharris · 2026-09-20
- vLLM 首日支持 Qwen-Image-2.1:KV cache 复用加速推理,附部署指南 — Alibaba_Qwen · 2026-09-20
- Krea 2 LoRA 训练求助:权重拉到 2.5 才生效怎么调 — DeltaWaffleSyrup · 2026-09-20
- Reddit 热议:Qwen Image 2.1 疑似大量蒸馏自 GPT 图像模型 — Netsuko · 2026-09-20
- Qwen Image 2.1 对决 Krea 2 Turbo:公斤指令、密集人群与混风格压力测试 — Crazy-Repeat-2006 · 2026-09-20
- Qwen-Image-2.1 INT8 ConvRot 量化版发布,进一步降低本地部署门槛 — Easy-Bike1524 · 2026-09-20