周末实战:用 OpenCode 蒸馏微调 Qwen3.5-4B 智能体

NielsRogge · x · 2026-08-10

开发者分享了一个周末实践项目:利用 OpenCode 工具包提取 GLM-5.2 的运行轨迹,并以此作为训练数据,通过 Q-LoRA 进行 SFT(监督微调),成功将能力蒸馏到 40 亿参数的 Qwen3.5 模型中。

由于模型是针对特定工具集训练的,它学会了直接调用 OpenCode 的内置工具。目前仅使用了 SFT,尚未引入 RL(强化学习)。微调后的模型已部署在 Hugging Face 的推理端点上。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →