SR-JEPA:在 3D 场景中学习预测潜在状态

burny_tech · x · 2026-08-10

SR-JEPA 提出了一种针对 3D 点云的联合嵌入预测架构(JEPA)。该模型能够在不依赖重建、语义标签或语言特征的前提下,仅通过自监督学习预测场景中被完全抹除的实体对象的潜在表示。

实验表明,模型推断出的潜在状态能够真实反映上下文推理,而非依赖位置捷径。在 ARKitScenes 等数据集上,该模型在预测缺失实体的语义身份和 3D 定位方面显著超越了基线方法,展现出强大的可查询与组合式 3D 预测能力。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →