4B 模型微调实战:Qwen3 蒸馏 72B 老师,分类准确率 72%→91%

Dangerous-Nerve-7766 · reddit · 2026-08-21

作者通过实验回答:在狭窄重复任务上,微调后的 4B 模型能多接近 72B 模型?任务为工单分类(6 标签)和发票提取(嵌套 JSON)。使用 Qwen2.5-72B-Instruct 生成合成数据作为 Teacher,在 Qwen3-4B 上进行 QLoRA 微调。

结果:

关键发现:Zero-shot 基线在发票提取上极差(1.2%全对),因为它系统性地违反了 Schema 的 Null 约定(如自行计算 subtotal 等于 total)。微调不仅提升了准确率,更重要的是学会了严格遵守 Schema 约定。成本在租用 4090 上每轮不到 2 美元。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →