Kandinsky 6.0 发布:音视频同步生成的开源基础模型

q5sys · reddit · 2026-10-08

Kandinsky 团队发布了 Kandinsky 6.0 Video,一套面向视频与音频同步生成的开源基础模型,已在 Hugging Face 上以 diffusers 格式开放权重。同时附赠一个配套的视频超分辨率(VSR)模型。作者试过 v5 版但印象一般,期待新版有所改进。

所属事件:Kandinsky 6.0 Video 以 MIT 协议开源音视频同步生成模型(7 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →