Qwen Image Edit 疑似按 1MP 训练:输入缩到 1024×1024 效果显著更好
Civil_Fee_7862 · reddit · 2026-08-26
作者发现 Qwen Image Edit 在生成/编辑图像时,先把图缩放到 1024×1024 编码、生成后再放回原尺寸,效果明显更好。推测原因是模型以 1MP 输入训练,但官方文档没有确认,发帖求证。作者还观察到 1MP 输入对其他模型也往往效果最佳。
「多模态」频道最新
- Pavo上线AgnesVideo2.5模型,免费策略降低AI短剧成本 — 新智元 · 2026-08-26
- 开源 Discord 插件:一键复制图片并生成 Krea2 提示词 — Ok_Clothes9170 · 2026-08-26
- MiniMax H3 唇舞视频工作流:1.4MP 分辨率需 3-4 小时 — TheDerminator1337 · 2026-08-26
- LAION-BVD:千万小时多模态预训练视频数据集 — Andreas Hochlehnert · 2026-08-26
- Reddit 用户用 AI 生成动画短片剧集《Realmz of the Redeemers》 — Kindly_Poet_7878 · 2026-08-26
- RTX 3070 上生成美国队长大战哈利波特:每 10 秒视频约 10 分钟 — luka06111 · 2026-08-26