ContextMaster 统一多镜头视频生成,单 GPU 达 16 FPS
KlingTeam · hf · 2026-08-07
ContextMaster 提出了一种名为交互式多镜头视频创作 (IMVC) 的全新设定,允许单一模型在生成、参考条件约束和编辑操作中保持连贯的共享历史。
为解决随历史增加而飙升的上下文读取成本,该模型引入了固定预算的稀疏上下文路由机制,并结合 ConstraintSink 确保任务约束始终可见。此外,研究提出两阶段特权上下文蒸馏框架,先通过一致性蒸馏从密集教师模型转移全上下文行为,再优化部署效果。
实验表明,该模型在多镜头任务中表现出优于专用基线的任务完成度与一致性,且在单张 GPU 上推理速度达到 16 FPS。
「多模态」频道最新
- 字节 Seedance 2.5 实测:多角色 49 秒长视频保持连贯 — SucceededMind · 2026-08-07
- 单图生成30秒视频:MiniMax H3本地实测与提示词拆解 — Tight_Organization54 · 2026-08-07
- Seedance 2.5支持高达30个参考输入 — OdinLovis · 2026-08-07
- MiniMax H3实测:画面惊艳,但仍搞不定“开门”逻辑 — martinerous · 2026-08-07
- Seedance 2.5 实测:支持原生 30 秒 4K 输出与多参考图锁定 — SucceededMind · 2026-08-07
- Lovart 推出年度订阅福利:赠送 Seedance 2.5 视频生成额度 — SimplyAnnisa · 2026-08-07