ImageNet 约 12% 验证集标签是错的,标注标准从未跟上需求
RexDouglass · x · 2026-09-03
在另一条相关转发中,klaaracz 指出 ImageNet 诞生于「猫还是狗」的时代,而如今的问题已是「哈士奇还是阿拉斯加」,标签体系从未跟上——原始验证集中约有 12% 的标签实际上是错的。
「研究」频道最新
- 可视化回顾 Eigenfaces:计算机视觉的开山之作与两个交互 demo — CSProfKGD · 2026-09-03
- 三篇论文拆解类人递归自我改进:ASPIRE、S³Gym 与 HarnessDev — teortaxesTex · 2026-09-03
- 穹彻智能发布Noe-0:全程不用遥操作数据训练具身模型 — jiqizhixin · 2026-09-03
- 研究挑战共识:用户回复里的「这不对/有用」反馈可训练利用 — LChoshen · 2026-09-03
- 研究测 13 款主流 LLM:10%-35% 陈述因说话者性别被改判真假 — anthara_ai · 2026-09-03
- 新论文 R³:用 RL 教机器人自由推理,先想后动提升策略控制 — aviral_kumar2 · 2026-09-03