MIT 开源 Kandinsky 视频+音频模型,6 个版本接入 Diffusers
RisingSayak · x · 2026-10-06
MIT 推出开源权重视频模型 Kandinsky,支持视频与音频联合生成。模型提供 6 个不同变体,在速度、显存占用与生成质量之间做了不同取舍,并附带两个超分辨率 checkpoint。Hugging Face Diffusers 团队已完成 day0 集成,发布当天即可直接调用。
所属事件:Kandinsky 6.0 Video开源:音视频同步生成,MIT协议放全权重(4 条相关)→
「多模态」频道最新
- 谷歌 Nano Banana 2.1 全面上线,4K 出图单张仅 $0.076 — testingcatalog · 2026-10-06
- 85mm 杂志感人像提示词模板:保留面部身份的编辑级出图 — aziz4ai · 2026-10-06
- iPhone 扫 3 分钟出一小时级照片级 3D 数字孪生 — willeastcott · 2026-10-06
- 独立开发者用 Opus 加 fframes 做宣传片,省掉 After Effects 数十小时 — kevinkern · 2026-10-06
- 「未发布照片」感 prompt 走红:50 只气象气球吊起沙发拍摄亚利桑那拖车公园 — techhalla · 2026-10-06
- 作者分享 Seedance 趣味视频 demo,附生成 Prompt 可复现 — techhalla · 2026-10-06