9B 微调碾压 31B 大模型:600 条标注只花 12 美分,准确率冲到 91%

julsimon · x · 2026-10-08

Julien Simon 用真实银行客服消息微调 Qwen3.5-9B,再在 180 条从未见过的消息上评测,结果:基座 Qwen3.5-9B 得 70.0%,Gemma 4 31B 零样本 77.8%,而微调后的 Qwen3.5-9B 达 91.1%,微调成本仅 0.12 美元。

做法要点:

他的结论:质量不够时大家的条件反射是换更大的模型,但好数据 + 小模型往往赢得更多,而且推理更快更便宜。代码已公开,可以直接复跑。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →