Qwen-Image-2.1 开源:7B 模型原生 RGBA、支持 10 张参考图编辑
ResearchCrafty1804 · reddit · 2026-09-20
阿里 Qwen 团队发布 Qwen-Image-2.1,定位系列中「最均衡、性价比最高」的图像模型,权重完全开源。要点:
- 轻量快速:7B 架构,号称性能超过多数闭源模型,多图输入推理大幅提速
- 原生透明通道:直接生成和编辑 RGBA 图层,可在透明图内无缝合成与改字
- 高保真编辑:最多支持 10 张参考图,精确局部控制,人像与产品保持严格保真
- 场景覆盖广:全景图、信息图、虚拟试穿,纹理真实、排版优雅
提供 Blog、GitHub、Hugging Face、ModelScope 全套入口,可立即下载使用。
所属事件:阿里开源 Qwen-Image-2.1:7B 统一生图与编辑,原生透明图(18 条相关)→
「多模态」频道最新
- Jev 稀疏注意力提速 MiniMax H3 视频生成,RTX 4070 耗时缩短 41.7% — TheMoonMidas · 2026-09-20
- 一张角色设定图加 MiniMax H3,静态游戏角色秒变活灵活现 — azed_ai · 2026-09-20
- Qwen Image 2.1 图像修复实测翻车:对比度漂移、颗粒感变合成噪点 — y3kdhmbdb2ch2fc6vpm2 · 2026-09-20
- 用 Codex Astra 接 Hyper3D Rodin MCP,一句指令造出可点击 3D 原型 — alex_verem · 2026-09-20
- NoSpoon 自主 agent 生成微短剧,连开发者都被剧情吊住 — Kyrannio · 2026-09-20
- 网友用 AI 生成 10 张 SCP-096 惊悚图像,还想拍短片 — VraserX · 2026-09-20