Qwen-Image-3.0 转向实用生成,但仍需提示词适配
量子位 · wechat · 2026-07-23
Qwen-Image-3.0 把图像生成往“能干活”推进了一步
这篇长测评围绕阿里 Qwen-Image-3.0 展开,核心不是“图更漂亮”,而是它能不能更实用地处理真实工作场景。
这代模型主打什么
- 细节真实:支持小字、公式、手写批注、纸张纹理等细节
- 内容丰实:能处理长提示词和复杂版面,比如报纸、试卷、分镜、PPT 风格页面
- 知识厚实:能画 UI 界面、多语种海报和常见直播/网页场景
文章里的实测结论
- 学术论文页、近景人物与宠物图表现较好
- 九宫格知识图解、多语种旅游海报等复杂排版也能做出来
- 还能生成较像样的微信文章页仿真图
- 但试卷类任务、速度和稳定性还有明显问题,且提示词适配非常关键
总体判断
相比前代 Qwen-Image,3.0 的进步是明确的,但距离“稳定交差、一次出活”还有一段路。
「多模态」频道最新
- 开源节点式 LoRA 训练器把打标、续训和显存监控放进一张图 — ashishsanu · 2026-07-23
- TERRA-129 作为 AI 动画科幻短片亮相,署名 Matygoo — Matygoo1 · 2026-07-23
- GPT Image 2 提示词主打角色身份与服装一致性 — eyishazyer · 2026-07-23
- 阿里发布 Qwen-Audio-3.0-TTS,支持 16 语言与 3 分钟单次生成 — Alibaba_Qwen · 2026-07-23
- 有人认为 Kling AI 的近景表情更自然 — burny_tech · 2026-07-23
- FameGrid Krea 2 试图生成更像真人发布的社媒图片 — UltraMuseArt · 2026-07-23