Qwen 开源 Qwen-Image-2.1:7B 图像生成与编辑模型原生支持透明层
RisingSayak · x · 2026-09-20
阿里通义开源 Qwen-Image-2.1,一个统一的文生图 + 图像编辑模型,视觉生成部分仅 7B 参数(32 层 Single-Stream DiT),已在 Diffusers 实现 Day-0 支持。
四大改进:
- 紧凑高效:混合粒度注意力 + 前缀 KV cache 复用,低算力下保持高质量生成
- 原生透明度:可从文本生成常规或 RGBA 透明图、编辑透明图层、从照片中抠取主体
- 灵活编辑:支持最多 10 张参考图,可通过圈选、标注或掩码指定局部编辑,并保留人物/产品身份
- 质感提升:改进排版、人像光照与细节
模型已在 Hugging Face 开放(Qwen/Qwen-Image-2.1),提供 QwenImage21Pipeline 快速上手代码。
所属事件:阿里开源 Qwen-Image-2.1:7B 统一生图与编辑(20 条相关)→
「多模态」频道最新
- Qwen-Image 2.1 实测:30.8GB 本地跑,透明与文字处理出色 — DevDminGod · 2026-09-20
- 网友用 AI 生成墓碑,石刻纹理与光影效果惊艳 — floguo · 2026-09-20
- TischLog #46 发布:专为 Midjourney V8.2 打造的赛博朋克风格包 — tisch_eins · 2026-09-20
- 用户实测:Yue2 bf16 量化版节奏崩坏,int8 反而更稳 — Inevitable_Pen9043 · 2026-09-20
- Grok 生图 + Veo 生视频 + Topaz 放大:古希腊方阵创作流水线 — creatoroff · 2026-09-20
- ComfyUI 单文件版 Qwen-Image-2.1 登上 Hugging Face 热门 — Comfy-Org · 2026-09-20