LeVJEPA:无需启发式的视频预训练,计算量降低20倍性能持平
iScienceLuvr · x · 2026-08-28
研究团队提出LeVJEPA,首个在LeJEPA无崩溃目标下训练的视频编码器。在相同epoch和相同数据下,LeVJEPA在ViT-S/B/L上以5.6至20.8倍更少的预训练计算量匹配或超越V-JEPA 2;在相同总FLOPs下,在ImageNet-1K上超过最强视频基线7.6点,同时在运动中心基准上保持竞争力。与计算匹配的DINOv2相比,LeVJEPA在表观中心评估上接近图像预训练编码器,而运动中心准确率几乎翻倍。
「研究」频道最新
- 巴黎 AI 工程师大会演讲:后训练与端侧 Agent — helloiamleonie · 2026-08-28
- 实测:Qwen Engram 压缩潜力与 Zipf 分布 — I-am_Sleepy · 2026-08-28
- 大佬建议:构建微型模型培养训练直觉 — psuraj28 · 2026-08-28
- Transfyr 实验解析AI:自动识别实验动作与器具 — RexDouglass · 2026-08-28
- SpatialCrafter:单图生成可控 3D 场景视频 — kwangmoo_yi · 2026-08-28
- 预训练行为相关性或导致单一基因控制多特质 — xuanalogue · 2026-08-28