LeVJEPA:无需启发式的视频预训练,计算量降低20倍性能持平

iScienceLuvr · x · 2026-08-28

研究团队提出LeVJEPA,首个在LeJEPA无崩溃目标下训练的视频编码器。在相同epoch和相同数据下,LeVJEPA在ViT-S/B/L上以5.6至20.8倍更少的预训练计算量匹配或超越V-JEPA 2;在相同总FLOPs下,在ImageNet-1K上超过最强视频基线7.6点,同时在运动中心基准上保持竞争力。与计算匹配的DINOv2相比,LeVJEPA在表观中心评估上接近图像预训练编码器,而运动中心准确率几乎翻倍。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →