ARROW 发布:任意图像集统一 3D 重建与点跟踪,刷新两项 SOTA
CSProfKGD · x · 2026-10-04
RWTH 团队发布前馈模型 ARROW,将 D4RT 风格的解码扩展到更广输入类型:多视角视频与无序图像集合。
- 核心是一种顺序不变的查询机制,可跨任意输入(不同视角、拍摄时间、可见性变化)建立观测对应关系
- 训练时暴露于更多样输入集合,显著提升任务表现,并可泛化到多视角跟踪等更多任务
- 在 WorldTrack 与 TAPVid-3D 上取得 3D 跟踪新 SOTA,在纯 RGB 的 MVTracker 基准上超过专用多视角跟踪器,同时在 3D 重建任务保持竞争力
- 代码与权重已开源,论文见 arXiv:2610.01314
所属事件:RWTH 发布 ARROW 模型:任意图像输入统一 3D 重建与点跟踪(2 条相关)→
「研究」频道最新
- 稀疏 Transformer 单个权重可用 Python 代码表达,可解释性论文入选 NeurIPS — CatAstro_Piyush · 2026-10-04
- 从嵌入到 HNSW/IVF/PQ:一篇讲透向量数据库原理的入门长文 — blaizedsouza · 2026-10-04
- CoFlow 用对比轨迹排斥减少 Flow Matching 轨迹交叉,提升少步生成 — burny_tech · 2026-10-04
- 潜空间通信论文合辑:多智能体 KV-Cache 完整性与状态轨迹传输 — burny_tech · 2026-10-04
- 绕开离散优化局部最优:DNA 设计先用梯度下降再查合成商目录 — anshulkundaje · 2026-10-04
- 神经科学实证:生物神经网络的突触可塑性近似反向传播 — aran_nayebi · 2026-10-04