阿里发布 Qwen-Image-3.0,支持 4.5K 提示词和 10px 小字
airesearch12 · x · 2026-07-21
阿里这次放出的 Qwen-Image-3.0,重点明显放在 文字排版和复杂版面 能力上。
- 官方说它支持最长 4.5K tokens 的提示词。
- 还能生成小到 10px 仍可读的文字。
- 支持 12 种语言,以及 100+ 种视觉风格。
- 演示里包括整版报纸、试卷、界面,以及一次性生成 3×3 九宫格信息图。
- 虽然还没有独立 benchmark,但从官方示例看,它对“密集文字+复杂布局”的图片生成很强,实用性很高。
原帖也把这视为中文实验室在图像生成赛道继续高速推进的一个信号。
所属事件:阿里发布 Qwen-Image-3.0,主打复杂排版与多语言渲染(17 条相关)→
「多模态」频道最新
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11
- ComfyUI 新节点发现器上线:按 star 增速过滤最新热门节点 — Luke2642 · 2026-09-11
- 用 MiniMax H3 MAX 对一只蚊子放大招,蚊子毫发无伤 — Hailuo_AI · 2026-09-11