CER 已不适合全页 OCR 时代:全页任务要做的风格决策全被算成阅读错误
staghado · x · 2026-09-03
staghado 详细论证为何 CER 已不适应现代 OCR 评测:CER 曾适用于 CRNN+CTC 时代的行/词级评估——固定词表、无格式、无阅读顺序、无版面,几乎没有约定空间;而现在任务是全页的,模型要做数十种风格决策,而 ground truth 只在十年前选定了其中一种写法,CER 会把所有这些差异都算作阅读错误。但他补充:如果基准是行级/词级的,CER 仍然适用。
所属事件:0.8B Qwen 微调转写两千份中世纪手稿,CER 指标引争议(4 条相关)→
「模型」频道最新
- 网友推测 Google Astra 的能力跃升主要来自视觉 — dumquestions · 2026-09-05
- 20美元/200美元档最具性价比 AI 订阅榜单更新 — popiazaza · 2026-09-05
- antirez 盛赞 Astra:RLVR 规模化的大模型让软件开发跃升 — antirez · 2026-09-05
- 重度用户力挺 Astra:直觉智能碾压同价的 Fable 5.1 — DynaBeast · 2026-09-05
- 问 Fable 5.1 生物安全论文被拒:网友吐槽遭遇「Opus 式拦截」 — nathanbenaich · 2026-09-05
- 同一道电脑检查题,Claude 与 GPT-6 Astra 给出相反答案 — Jardani_xx · 2026-09-05