具身视觉模型在深度与分割上领先

thetripathi58 · x · 2026-07-08

帖子称,SigLIP 2 在 ImageNet 分类上表现更好,但对机器人更关键的是密集空间任务。

LingBot-Vision 在深度估计上比 Google 的模型提升约 40%,同时在 ADE20K 分割基准上还增加了 10.8 mIoU。

所属事件:蚂蚁灵波开源LingBot视觉基座,深度感知斩获多项第一(18 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →