Qwen 发布两款 Qwen3.5-VL 9B 微调模型:自动改写图生图/T2I 提示词
Technical_Fish_9638 · reddit · 2026-09-21
Qwen 团队为 Qwen-Image-2.1 发布了两款微调的 Qwen3.5-VL 9B 提示词改写模型,统一代码库可自动识别输入模式:
- Qwen-Image-2.1-PE-I2I:图像编辑提示词增强;Qwen-Image-2.1-PE-T2I:文生图提示词增强
- 会从用户输入自动推断宽高比/分辨率并连同增强后的提示词以 JSON 输出,官方 GitHub 提供两套 system prompt
- 权重提供 18.8GB 原版、GGUF(4.6-17.9GB)、FP8 vLLM(13.5GB)等多种格式
- 推荐参数:temperature=1.0、topp=0.95、topk=20
- 发帖人用 llama.cpp 快速对比了 i2i 改写效果:改写后的编辑指令会详细枚举要移除/重建/保留的每个细节,明显比原始短指令信息量更大,作者考虑用它替代 Klein 9B
所属事件:Qwen 发布带提示词改写能力的图像生成系列新模型(2 条相关)→
「多模态」频道最新
- Qwen-Image 2.1 开源:SGLang 首日支持,单卡 4090 跑 22.7GB 显存 — ying11231 · 2026-09-21
- GPT-6 Astra 做 15 秒广告:逐帧拆解后重做,18 分钟出 5 版 — PrajwalTomar_ · 2026-09-21
- 4060 Ti 16GB 本地跑 MiniMax H3:5 秒视频需 500 秒,求提速方案 — GranDaddyP · 2026-09-21
- H3 v2v 动作参考实测:作者称做舞蹈视频 prompt 直出不如 v2v — R34vspec · 2026-09-21
- Nano Banana Pro 发布近一年,本地模型仍无对手能及的图像编辑能力 — TomasAhcor · 2026-09-21
- 闭源视频模型更强但更贵:每秒 23 美分的迭代代价 — LowYak7176 · 2026-09-21