vLLM 首日支持 Qwen-Image-2.1:KV cache 复用加速推理,附部署指南

Alibaba_Qwen · x · 2026-09-20

vLLM 项目宣布对 Qwen-Image-2.1 提供首日(day-0)支持,Qwen 官方转发致谢。技术上,Qwen-Image-2.1 是 7.1B 单流 DiT(块因果注意力)搭配 Qwen3-VL-8B 文本编码器和 16x RGBA 自编码器,一个模型同时服务文生图与图像编辑。

vLLM-Omni 的优化要点:

一个 QwenImage21Pipeline 即可同时跑生成与编辑,无需单独加载编辑模型。官方配方给出采样默认值:40 步、cfg-scale 设 1.0(仅配负向提示词时才有效)。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →