Unsloth 用 4GB 显存把 Qwen3.5 0.8B 决策准确率从 20.7% 提到 74.3%

kalyan_kpl · x · 2026-10-08

Unsloth 团队宣布可在本地训练你自己的"决策模型":他们用 Clef head + LoRA(r=64)微调 Qwen3.5 0.8B 一个 epoch,在 3 个决策基准上的综合准确率从 20.7% 提升到 74.3%,下游准确率从 30–37% 提至 78%,全程仅需 4GB 显存。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →