CMU 联合 Meta 发布 TrackEverything:可追踪 1000+ 帧长视频全点轨迹
AdamWHarley · x · 2026-09-26
卡内基梅隆大学与 Meta 研究者发布 TrackEverything,一个面向长视频的 3D 稠密点追踪器,能同时追踪 1000+ 帧视频中的所有点。
- 核心思路:把计算绑定到唯一的 3D 场景内容上,通过「去重 3D 场景表示」避免在冗余 2D 像素上重复计算。
- 方法将视频表示为世界坐标系下的持久 3D 场景轨迹,天然处理相机运动,并对动态/静态点做分类以精简渲染。
- 项目页展示了大量全长序列的稠密追踪可视化结果(含舞蹈视频等);论文已上 arXiv,代码即将开源。
- 作者来自 CMU 与 Meta,包括 Ayush Jain、Adam W. Harley、Katerina Fragkiadaki、Jakob Engel 等。
「多模态」频道最新
- 毫秒级、近乎零成本的小图像模型,解锁工业自动化新用例 — airesearch12 · 2026-09-26
- Krea2 Turbo 2 步蒸馏 LoRA 新版:去噪提速 4.2 倍 — TimeTruth2490 · 2026-09-26
- 全视频纯代码零 AE:开发者开源 Claude 动效设计 prompt 模板 — EricBuess · 2026-09-26
- viggle-turbo 速度更快,多数提示词下效果不输原版 — init-5 · 2026-09-26
- Blender 智能体预演镜头,fal 新模型一键转写实视频 — gorkem · 2026-09-26
- 用 Claude Opus 5.5 制作短片《From Rocks to AI》 — coherence · 2026-09-26