Kandinsky 6.0 发布:音视频同步生成的开源基础模型
q5sys · reddit · 2026-10-08
Kandinsky 团队发布了 Kandinsky 6.0 Video,一套面向视频与音频同步生成的开源基础模型,已在 Hugging Face 上以 diffusers 格式开放权重。同时附赠一个配套的视频超分辨率(VSR)模型。作者试过 v5 版但印象一般,期待新版有所改进。
所属事件:Kandinsky 6.0 Video 以 MIT 协议开源音视频同步生成模型(7 条相关)→
「多模态」频道最新
- 10GB 显卡跑通 TRELLIS.2 图生 3D,作者开源 CLI 与关键参数 — hamper10 · 2026-10-08
- 视频剪辑正经历编程曾经的巨变,实测者直呼震撼 — ayushtweetshere · 2026-10-08
- AI 视频生成做到同一角色每镜头不变,一致性演示走红 — no3us · 2026-10-08
- 印度 IICT 联合 YouTube 首发四部 AI 创作短片 — lmoroney · 2026-10-08
- Lora Pilot 轻松实现视频每幕同一角色,一致性 demo 走红 — no3us · 2026-10-08
- Vidu Q4 Preview 上榜 AA 图生视频榜,图生视频 Vidu Q4 Preview 登顶前三 — ArtificialAnlys · 2026-10-08