Kandinsky 6.0 视频生成模型开源,vLLM 同日提供推理支持
vllm_project · x · 2026-10-06
Kandinsky 6.0 Video 以 MIT 协议开源,包含 Lite(3B) 和 Pro(29B) 两个规模的扩散模型,支持从文本或图像生成 5 秒、带 44kHz 同步音频与口型同步的视频(T2AV / TI2AV 两种模式),还可通过插件式超分模型输出 1920×1080 Full-HD。
vLLM 的统一推理项目 vLLM-Omni 宣布 Day-0 支持该模型,发布当天即可用 vLLM 跑推理。官方仓库还提供 ComfyUI 插件与快速上手脚本,需 NVIDIA GPU 和 Python 3.13+,首次运行自动下载 Pro Distill 5s 权重。
所属事件:Kandinsky 6.0 Video开源:音视频同步生成,MIT协议放全权重(4 条相关)→
「多模态」频道最新
- Nano Banana 2.1搞定龟背竹叶缝嵌字难题,Pro仍更稳 — fofrAI · 2026-10-07
- ID-Forcing 方法让自回归视频模型无需微调生成分钟级长视频 — _akhaliq · 2026-10-07
- Google 多模态嵌入模型:图像 280 token、音频每秒 25 token 计价 — tomaarsen · 2026-10-07
- Google 多模态嵌入模型:视觉 token 预算 70 至 1120 可调 — tomaarsen · 2026-10-07
- 嵌入模型任务前缀指南:SearchQuery 配 Document 做检索 — tomaarsen · 2026-10-07
- Matryoshka 训练加持:嵌入维度可裁至 256d 存储省三分之二 — tomaarsen · 2026-10-07