阿里 Qwen-Image 3.0 主打 4,500 token 提示词与可读小字
matchaman11 · x · 2026-07-21
阿里发布的 Qwen-Image 3.0 被包装成图像生成能力的一次明显跃升。
帖子宣称它可以:
- 支持最长 4,500 tokens 的提示词
- 生成可读的 10px 小字
- 原生支持 12 种语言
- 生成报纸、试卷、复杂 UI 等版式内容
- 一张图里直接做出 3×3 信息图网格
- 覆盖 100+ 种视觉风格
配图重点展示的是它在文字渲染和复杂排版上的控制力,尤其适合多语言和文档式图像生成。
所属事件:阿里发布 Qwen-Image-3.0,主打密集排版与多语种文字渲染(11 条相关)→
「多模态」频道最新
- 先做分镜再生成,AI 舞蹈视频更容易保持一致性 — aftahi_ai · 2026-07-22
- 交互式视频更该看响应速度,而不只是画质 — Soggy_Limit8864 · 2026-07-22
- Runpod MCP 让 Claude 直接编排图像和视频生成工作流 — 802high · 2026-07-22
- Midjourney 把蜜蜂做成碎片爆炸梗图 — michaelrabone · 2026-07-22
- 物理奖励能改进视频生成,但不等于物理引擎 — Dapper-Drawer4546 · 2026-07-22
- HeyGen 给 coding agent 接入 7.5 万图片和 1 万音乐 — HeyGen · 2026-07-22