LocateAnything-Data 开源 1200 万图像和 7.85 亿标注
ZhidingYu · x · 2026-07-27
Zhiding Yu 发布了 LocateAnything-Data,一个面向更强多模态模型的开源空间数据集。
该数据集包含 1200 万张图片、1.38 亿个 query、7.85 亿条空间标注,覆盖检测、指代表达定位、Physical AI、GUI 理解、OCR 和文档理解。与此同时,团队还开源了可复现的训练流水线,包括统一空间标注、JSONL、索引化 WebDataset TAR、Megatron-Energon 配置、源媒体映射,以及可视化和加载示例。
所属事件:LocateAnything 开源含千万图像的多模态数据集(2 条相关)→
「研究」频道最新
- 新论文 PFD 统一解释 SDS 模式坍缩,蒸馏收敛更快方差更低 — burny_tech · 2026-09-23
- 剑桥出版高维统计新教科书,Samworth 与 Shah 合著免费开放 — FrnkNlsn · 2026-09-23
- Reinforce-Ada:按难度自适应分配算力,RLVR 收敛加速至 2 倍 — burny_tech · 2026-09-23
- 论文:Transformer 并非没有世界模型,而是特征叠加互相干扰 — burny_tech · 2026-09-23
- 新论文称 Transformer 难以学会 loop-closure 世界建模 — burny_tech · 2026-09-23
- Epoch AI 报告:「思考」的价格正在暴跌,智能成本持续陡降 — Proper_Actuary2907 · 2026-09-23