MIT 开源 Kandinsky 视频+音频模型,6 个版本接入 Diffusers

RisingSayak · x · 2026-10-06

MIT 推出开源权重视频模型 Kandinsky,支持视频与音频联合生成。模型提供 6 个不同变体,在速度、显存占用与生成质量之间做了不同取舍,并附带两个超分辨率 checkpoint。Hugging Face Diffusers 团队已完成 day0 集成,发布当天即可直接调用。

所属事件:Kandinsky 6.0 Video开源:音视频同步生成,MIT协议放全权重(4 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →