Qwen-Image-3.0 让阿里图像生成进入密集文本与多语种时代
智东西 · wechat · 2026-07-21
- 这篇报道说,阿里千问第三代图像模型 Qwen-Image-3.0 已经发布。
- 最大升级点是把图像生成推进到“可生产”的层面:支持最高 4.5k token 输入,能直接生成报纸、分镜、试卷等高密度版面。
- 文章称它可以渲染到 10px 小字,还能更细致地还原毛孔、发丝等微观细节,并原生支持 12 种语言。
- 重点能力还包括文字对齐、多图叙事一致性、复杂构图和 UI 式场景生成。
- 报道还提到,阿里云百炼和千问平台已开放 API 邀测,QwenStudio 和千问 App 也将上线。
所属事件:阿里发布 Qwen-Image-3.0,主打 4.5K 提示词与多语言文字渲染(10 条相关)→
「多模态」频道最新
- Fable 为 The Loom 一次做出音乐、乐器和视频 — Sauers_ · 2026-07-21
- 开源 TTS 清单按许可证优先筛选可商用模型 — mahimairaja · 2026-07-21
- AI 戏仿把 Chris Cornell《American Nightmare》做成了梗图海报 — 77sevens · 2026-07-21
- AI 游戏演示开始实时生成声音,配合世界模型画面 — mark_k · 2026-07-21
- Krea2 找到 Raw 4 步加 Turbo 4 步的图像工作流 — PropagandaOfTheDude · 2026-07-21
- Hugging Face 截图显示 Anima 扩散模型多个版本 — RafiHDW · 2026-07-21