ParseBench 曝 OCR 模型需读取不可见文本,评测标准引质疑
IgorCarron · x · 2026-10-06
staghado 在转发 ParseBench 评测样本时指出一个反直觉现象:OCR 模型现在被要求读取不可见的文本——样本中存在隐形的文本内容,而评测的 expected ground truth 却包含这些内容。这一发现引发对 OCR 评测基准合理性的质疑。
「模型」频道最新
- Mistral 发布 Large 4:1T 参数原生多模态,欧洲最强开源权重模型 — mervenoyann · 2026-10-06
- Mistral Large 4 每题耗 token 超 GPT-6 两倍,智能还不及对手 — haider1 · 2026-10-06
- Reflection AI 称 Beam 推理效率达 GLM 5.2 的 3-4 倍 — ChrSzegedy · 2026-10-06
- 连串新模型密集发布,网友称西方迎来「模型之春」 — serious_mehta · 2026-10-06
- Mistral 高管盛赞自家新模型:科学团队成果让产品线将齐聚 — onetwoval · 2026-10-06
- Mistral Large 4 上线 OpenRouter 预览:1T 参数、512K 上下文 — _AndrewZhao · 2026-10-06