Qwen-Image-3.0 发布,支持 4.5k token 输入和更细文字渲染
pony57163 · reddit · 2026-07-21
QwenTeam 发布了 Qwen-Image-3.0,主打“更实用”的高细节图像生成。
- 支持最长 4.5k token 输入,可一次生成信息图、报纸、试卷、分镜、嵌套界面等高信息密度画面。
- 细节能力强调进一步提升,号称能更准确渲染 10 px 小字、论文公式、批注,以及发丝、毛孔、传统绘画修复等微观纹理。
- 还支持 12 种语言、100+ 艺术风格 和多类 UI 界面仿真,并可结合联网信息生成更贴近真实场景的图像。
所属事件:阿里发布 Qwen-Image-3.0,主打 4.5K 提示词与多语言文字渲染(10 条相关)→
「多模态」频道最新
- 一款不知名 AI 模型被指在细节和 3D 建模上赢过 Opus 4.8 — 1ilikemoths1 · 2026-07-21
- NVIDIA 推出 Nemotron 音频原生开源权重模型,提供 2B 和 30B 版本 — victormustar · 2026-07-21
- HOMIE 用 Qwen3-VL-2B 和 Wan2.1 做人物物体视频个性化 — switch2stock · 2026-07-21
- 视频模型将广告制作成本降低90-99%,Runway实测数据 — c_valenzuelab · 2026-07-21
- Pablo Stanley 分享 ChatGPT 到 CapCut 的 AI 视频流程 — jdjohnson · 2026-07-21
- Meta AI 文本输入开始支持图文交错输入 — ezyang · 2026-07-21