手稿转写模型为何还在用 CER:作者详解评测取舍与 CATMuS 规范

wjb_mattingly · x · 2026-09-04

针对「CER 是否还是合理评测指标」的讨论,作者补充:其手稿转写模型的 CER 误差主要来自风格与拼写差异,属可理解范围;但 CER 在校验模型表现、让其符合 CATMuS 转写规范的过程中起了关键作用,只是如今指标确实变得更复杂了。

背景:这是 0.8B Qwen 3.5 在 2000+ 中世纪手稿(万页)上全量微调项目的后续讨论。

所属事件:0.8B Qwen 微调转写两千份中世纪手稿,CER 指标引争议(4 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →