Kandinsky 6.0 视频生成模型开源,vLLM 同日提供推理支持

vllm_project · x · 2026-10-06

Kandinsky 6.0 Video 以 MIT 协议开源,包含 Lite(3B) 和 Pro(29B) 两个规模的扩散模型,支持从文本或图像生成 5 秒、带 44kHz 同步音频与口型同步的视频(T2AV / TI2AV 两种模式),还可通过插件式超分模型输出 1920×1080 Full-HD。

vLLM 的统一推理项目 vLLM-Omni 宣布 Day-0 支持该模型,发布当天即可用 vLLM 跑推理。官方仓库还提供 ComfyUI 插件与快速上手脚本,需 NVIDIA GPU 和 Python 3.13+,首次运行自动下载 Pro Distill 5s 权重。

所属事件:Kandinsky 6.0 Video开源:音视频同步生成,MIT协议放全权重(4 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →