Qwen-Image-2.1 开源:7B 统一生图与编辑,支持 RGBA 透明层
linoy_tsaban · x · 2026-09-20
阿里 Qwen 团队开源 Qwen-Image-2.1,一个统一的文生图与图像编辑模型,视觉生成部分仅 7B 参数(32 层 Single-Stream DiT),兼顾质量、推理效率与多用途。四大亮点:
- 紧凑高效:混合粒度注意力 + 前缀 KV cache 复用,低成本出高质量图
- 原生透明通道:文生 RGBA 透明图、编辑透明图层、从照片抠主体,一个模型全包
- 多参考图编辑:最多 10 张参考图,可用圆圈、涂鸦标注或独立蒙版指定局部编辑,并保持人物/产品身份一致
- 质感与美学提升:排版、人像打光与细节更真实
已在 Hugging Face(权重与 Demo Space)、ModelScope、GitHub 开放,支持 Diffusers 一行加载。
所属事件:阿里开源 Qwen-Image-2.1:7B 统一生图与编辑,原生 2K 与透明图(15 条相关)→
「多模态」频道最新
- Qwen-Image-2.1 上架 Hugging Face:支持图像生成与编辑 — Qwen · 2026-09-20
- 用 Codex Astra 接 Hyper3D Rodin MCP,一句指令造出可点击 3D 原型 — alex_verem · 2026-09-20
- NoSpoon 自主 agent 生成微短剧,连开发者都被剧情吊住 — Kyrannio · 2026-09-20
- 网友用 AI 生成 10 张 SCP-096 惊悚图像,还想拍短片 — VraserX · 2026-09-20
- Qwen Image 2.1 首小时实测:对比 2511 编辑不占优,没有惊喜感 — LowYak7176 · 2026-09-20
- Qwen-Image-2.1 采用严格非商用许可,且无营收上限条款 — ostrisai · 2026-09-20