阿里 Qwen-Image-3.0 发布:单次生成可渲染 10 像素清晰文字
The Decoder · rss · 2026-07-21
阿里巴巴 Qwen 团队发布了全新的图像生成模型 Qwen-Image-3.0。该模型在文本渲染和复杂排版方面实现了显著突破。
主要亮点包括:
- 长提示词支持:可处理长达 4,500 tokens 的提示词。
- 极限文字渲染:能生成清晰可读的最小至 10 像素的文字。
- 复杂排版能力:支持原生处理 12 种语言,可在单次生成中输出完整的信息图表网格、LaTeX 论文页面和报纸版面等复杂布局。
不过报道也指出,由于输出的是像素级图像而非可编辑格式,其在实际工作流中的实用性仍有待观察。
「模型」频道最新
- 谷歌发布三款 Gemini 模型,其中一款主攻网络安全 — Polymarket · 2026-07-22
- Google 称搜索信息代理将于今夏登陆 AI Pro 和 Ultra — gaganghotra_ · 2026-07-22
- Poolside 的 Laguna S 2.1 在 Nous Portal 免费开放两周 — NousResearch · 2026-07-22
- Qwen3.8 Max Preview 横评后被认为明显进步 — curiousily_ · 2026-07-22
- Moonshot 的 Kimi K3 登上 MathArena 第五名开源最佳 — xeophon · 2026-07-22
- Google 推出 Gemini 3.5 Flash Cyber,限量供政府和可信伙伴使用 — GoogleAI · 2026-07-22