字节提出 DuoMatching:少步数视频生成人类偏好超 80%
ByteDance · hf · 2026-10-07
字节跳动发布 DuoMatching 框架,改进基于分布匹配蒸馏(DMD)的流式视频生成。方法要点:
- 在已有的联合分布匹配之上,引入边缘匹配目标,由图像生成器提供帧级监督,迁移互补的视觉与语义先验;
- 提出 LatentBridge 解决视频学生模型与图像教师模型之间的隐空间表示不匹配;
- Latent Variation Sampling 将帧级监督分散到不同时间段,降低冗余。
实验显示 DuoMatching 在视觉质量、构图与语义对齐上全面改善,同时基本保留运动动态;人类评估中对所有基线的整体偏好率超过 80%。
「多模态」频道最新
- 揭秘 Claude Opus 5.5 做视频:核心是模型写程序来画 — dotey · 2026-10-07
- ComfyUI Qwen 图像增强节点新增参考图局部遮罩控制 — Capitan01R- · 2026-10-07
- DRAMA 1.0 发布:只改表情层,已拍视频一键切换 10 种情绪 — nikola_mr64990 · 2026-10-07
- 10.5k 星 video-shotcraft:用 Claude Code 自动产出电影感产品视频 — tom_doerr · 2026-10-07
- 实测称 Nano Banana 2.1 更便宜、快 5 倍且强于 ChatGPT 图像 — prajdabre · 2026-10-07
- DistScene:单图生成组合式 3D 场景,显式建模环境提升空间一致性 — Kunming Luo · 2026-10-07