LingBot-Vision:基于边界建模的自监督 ViT

tom_doerr · x · 2026-08-23

LingBot-Vision 发布了一套用于密集空间感知的自监督视觉 Transformer (ViT) 骨干网络,参数规模从 ViT-S/16 到 11 亿参数的 ViT-g/16。

核心特点:

项目包含代码实现、示例及配套论文。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →