含 1200 万图像的开源多模态空间数据集 LocateAnything 发布
ZhidingYu · x · 2026-07-28
LocateAnything-3B 模型此前登顶 Hugging Face Trending 榜首。为了帮助社区构建更强大的多模态模型,团队正式开源了配套的高质量训练数据集 LocateAnything-Data。
- 数据规模:包含 1200 万张图像、1.38 亿条查询以及 7.85 亿条标注。
- 覆盖任务:多目标检测、指代表达定位、物理 AI、GUI 理解、OCR 以及文档理解。
- 开源目标:降低复现门槛,方便社区进行扩展,从而训练出性能更强的多模态模型。
所属事件:LocateAnything 开源含千万图像的多模态数据集(2 条相关)→
「研究」频道最新
- 基因组语言模型 Minerva 上线:发现逆转录酶系统编码全新 ncRNA — BrianHie · 2026-09-23
- q-Neurons:用随机 q 导数激活函数提升神经网络性能 — FrnkNlsn · 2026-09-23
- 曝 OpenAI 将办期刊:内部模型多 agent 评审,冲击 ML 会议 — kfountou · 2026-09-23
- 耶鲁博士生开源顶会论文画图脚本,还能接入 Claude Code 当 Skill — burny_tech · 2026-09-23
- AI 在 ForecastBench 上追平超级预测员,10 月将再战 — burny_tech · 2026-09-23
- 几句 prompt 让 Opus 用 Lean 形式化验证 Agent SDK,产出 16 个修 bug PR — bcherny · 2026-09-23