Qwen-Image-3.0 发布,支持 4.5k token 输入和更细文字渲染
pony57163 · reddit · 2026-07-21
QwenTeam 发布了 Qwen-Image-3.0,主打“更实用”的高细节图像生成。
- 支持最长 4.5k token 输入,可一次生成信息图、报纸、试卷、分镜、嵌套界面等高信息密度画面。
- 细节能力强调进一步提升,号称能更准确渲染 10 px 小字、论文公式、批注,以及发丝、毛孔、传统绘画修复等微观纹理。
- 还支持 12 种语言、100+ 艺术风格 和多类 UI 界面仿真,并可结合联网信息生成更贴近真实场景的图像。
所属事件:阿里发布 Qwen-Image-3.0,主打复杂排版与多语言渲染(17 条相关)→
「多模态」频道最新
- 3D ResNet 论文八年突破 3000 引用,Kinetics 数据集成里程碑 — HirokatuKataoka · 2026-09-11
- 零编程经验者用 ChatGPT 开发 ComfyUI 安卓客户端将上架 — ComfierUI · 2026-09-11
- FastH3-Live 升至 22fps:加速节点实测与 ComfyUI 显存避坑 — spartong945 · 2026-09-11
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11