字节跳动发布 Trace Anything,实现视频 4D 轨迹场表征

tom_doerr · x · 2026-08-16

字节跳动 Seed 团队发布了 Trace Anything 模型,这是一种 4D 视频表征方法。它通过轨迹场将视频每一帧的像素映射到连续的参数化 3D 轨迹上。该模型仅需单次前向传播,即可高效估算任意视频、图像对或非结构化图像集的轨迹场。官方已在 GitHub 开源 PyTorch 实现代码及交互式 3D 查看器,相关论文入选 ICLR 2026。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →