vLLM 集成 Transformers 后端,文本图像音频视频全模态统一推理

LysandreJik · x · 2026-10-06

vLLM 宣布其 Transformers modelling backend 现已支持文本、图像、音频、视频全部模态,无需任何手写的 vLLM 模型适配代码——模型只需以 --model-impl transformers 启动即可直接服务。视频支持由 Harshal Janjani 贡献,将随 vLLM v0.32.0 发布。这意味着任何 Transformers 支持的模型都能零适配成本接入 vLLM 推理栈。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →