CineScale:开源视频模型免微调推理时直出4K高清视频
liuziwei7 · x · 2026-09-14
南洋理工与 Netflix Eyeline Studios 发布 CineScale,号称首个免微调的高分辨率视频生成框架,并已集成进 Wan。
核心内容
- 大多数视频扩散模型受限于 720p 训练分辨率,难以在推理时生成更高清视频。
- CineScale 通过将 query token 划分为空间分块的分块自注意力,同时保留全局 keys/values 访问,配合自适应校正 RoPE(AR-RoPE)维持局部几何精度并约束长程位置偏移。
- 无需任何额外微调,开源模型(如 Wan)即可在推理时生成远超训练分辨率的 4K 高保真视频。
- 论文包含与 RoPE、NTK-RoPE 的基线对比及级联步数消融实验。
「多模态」频道最新
- MiniMax 3步 Turbo LoRA 实测:RTX 5090 上 2 分钟出带音频视频 — agapes1270 · 2026-09-14
- 开发者用 ChatGPT 写码做出 ComfyUI 提示词库自定义节点 — MediocreRegister9642 · 2026-09-14
- Miroir 发布 AI 导播一体机 Director 4K,自动切镜跟踪人脸 — JiliJeanlouis · 2026-09-14
- 开源 ComfyUI 节点上线,用 MiniMax H3 一键重打光生成视频 — Emotional_Example_12 · 2026-09-14
- 不等暴雪,博主用 GPT Image + Seedance 自制 Diablo 预告片 — techhalla · 2026-09-14
- AI 生成短片《The Ninth Bell》:锁闭歌剧院里的盗窃惊悚片 — Icy-Grand-4355 · 2026-09-14