RelateAnything:仅 5300 万参数,20ms 识别图中物体关系的开源 CV 模型

blaizedsouza · x · 2026-09-19

一个名为 RelateAnything 的开源开放词表计算机视觉模型引发关注:它仅凭原始像素和边界框,就能判断图中物体的交互关系(如拿着、穿着、坐在上面),内置对超过 19000 个关系词的理解,无需再训练。

关键数据:

对实时视频理解和具身智能应用潜力可观。

所属事件:RelateAnything 小模型 20ms 识别物体关系(2 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →