Qwen-Image-3.0 让阿里图像生成进入密集文本与多语种时代
智东西 · wechat · 2026-07-21
- 这篇报道说,阿里千问第三代图像模型 Qwen-Image-3.0 已经发布。
- 最大升级点是把图像生成推进到“可生产”的层面:支持最高 4.5k token 输入,能直接生成报纸、分镜、试卷等高密度版面。
- 文章称它可以渲染到 10px 小字,还能更细致地还原毛孔、发丝等微观细节,并原生支持 12 种语言。
- 重点能力还包括文字对齐、多图叙事一致性、复杂构图和 UI 式场景生成。
- 报道还提到,阿里云百炼和千问平台已开放 API 邀测,QwenStudio 和千问 App 也将上线。
所属事件:阿里发布 Qwen-Image-3.0,主打复杂排版与多语言渲染(17 条相关)→
「多模态」频道最新
- FastH3-Live 升至 22fps:加速节点实测与 ComfyUI 显存避坑 — spartong945 · 2026-09-11
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11
- ComfyUI 新节点发现器上线:按 star 增速过滤最新热门节点 — Luke2642 · 2026-09-11