0.8B Qwen 3.5 全量微调识读 2000+ 份中世纪手稿、共万页

wjb_mattingly · x · 2026-09-04

wjbmattingly 分享其历史文献数字化项目:用 0.8B 的 Qwen 3.5 做全量微调,训练数据来自 Comma 数据集的 2000 多份中世纪手稿、总计 10000 页(该数据集 CER 约 0.09),下周将在维也纳公开分享模型与细节。

在回复讨论中他也承认 CER 已不适合作为新评测的默认指标——这是在评测稀缺的小众领域对既有工作的务实沿用,未来计划尝试其他评测方法。

所属事件:0.8B Qwen 微调转写两千份中世纪手稿,CER 指标引争议(4 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →