0.8B Qwen 3.5 全量微调识读 2000+ 份中世纪手稿、共万页
wjb_mattingly · x · 2026-09-04
wjbmattingly 分享其历史文献数字化项目:用 0.8B 的 Qwen 3.5 做全量微调,训练数据来自 Comma 数据集的 2000 多份中世纪手稿、总计 10000 页(该数据集 CER 约 0.09),下周将在维也纳公开分享模型与细节。
在回复讨论中他也承认 CER 已不适合作为新评测的默认指标——这是在评测稀缺的小众领域对既有工作的务实沿用,未来计划尝试其他评测方法。
所属事件:0.8B Qwen 微调转写两千份中世纪手稿,CER 指标引争议(4 条相关)→
「研究」频道最新
- 模型会模糊记住「概念」而非原文:一场关于 SAE 特征与记忆的争论 — voooooogel · 2026-09-05
- ICML 立场论文:「无标签」不等于「无人类监督」,呼吁披露先验来源 — serrjoa · 2026-09-05
- 浙大与达摩院 VLA-Corrector:小模型审计划,机械臂成功率大涨 — 机器之心 · 2026-09-05
- 1.5ms 检出幻觉:开源 Spanda 比 Semantic Entropy 快 9 万倍 — Otherwise_Nobody_721 · 2026-09-05
- Bug Hunt Bench 发布:105 个真实 Bug 横测 GPT-6、Claude、Grok 等前沿模型 — PawelHuryn · 2026-09-05
- 数学家称同侪重名刊名校轻真理,AI 证明引文化反思 — avt_im · 2026-09-05