SR-JEPA:在 3D 场景中学习预测潜在状态
burny_tech · x · 2026-08-10
SR-JEPA 提出了一种针对 3D 点云的联合嵌入预测架构(JEPA)。该模型能够在不依赖重建、语义标签或语言特征的前提下,仅通过自监督学习预测场景中被完全抹除的实体对象的潜在表示。
实验表明,模型推断出的潜在状态能够真实反映上下文推理,而非依赖位置捷径。在 ARKitScenes 等数据集上,该模型在预测缺失实体的语义身份和 3D 定位方面显著超越了基线方法,展现出强大的可查询与组合式 3D 预测能力。
「研究」频道最新
- 学者向 OpenAI 提四大安全拷问:模型是否曾试图窃取自身权重? — OwainEvans_UK · 2026-08-10
- 独立开发者自研大模型共识榜,借鉴电竞算法解决评测排名难题 — 数字生命卡兹克 · 2026-08-10
- ICML 论文:让大模型「过度思考」可迫使其泄露隐藏知识 — PandaAshwinee · 2026-08-10
- 论文解读:使用广义均值扩展 Bhattacharyya 系数 — FrnkNlsn · 2026-08-10
- UIST 论文提出 GUIDE 系统:动态生成多模态交互显著缓解压力 — _Hao_Zhu · 2026-08-10
- 犯罪经济学家办黑客松:用 AI 批量生成论文初稿 — paulnovosad · 2026-08-10