4GB 显存 10 分钟微调:Qwen3.5 0.8B 决策模型准确率 37% 升至 65%
danielhanchen · x · 2026-10-10
开发者用 Unsloth Studio 在本地训练了一个 Jev 风格的小型决策模型:以 Qwen3.5 0.8B 为基座,仅 60 步 LoRA 训练(约 10 分钟)、4GB 显存,准确率即从 37% 提升到 65%。
作者附上了完整教程视频,章节涵盖:环境搭建、模型与数据集选择、LoRA 训练、应用内测试、代码版工作流、训练评估与推理部署。配套文章解释了 Jev 决策模型的理念——简单决策不必动用大 LLM,小模型毫秒级出结果且成本低得多。
「模型」频道最新
- Liquid AI 决策模型 d1 上线 Vercel AI Gateway,支持视觉输入 — maximelabonne · 2026-10-10
- 开源 TTS 排行榜更新:Paradee-8M 蒸馏自 Kokoro,1/10 参数持平 WER — realmrfakename · 2026-10-10
- Kimi API 网关延迟实测:GitHub 并发表现居首 — mariorod1 · 2026-10-10
- 用户把 Grok 拉进群聊后吐槽:消息不再私密了 — Angaisb_ · 2026-10-10
- Grok 机器人一次成功 Amazon 下单,购物 agent Muse 两度失败 — jamesperkins · 2026-10-10
- 长对话为何越聊越贵:每轮全量重发,prefix 缓存一改就失效 — ClickOk5811 · 2026-10-10