周末实战:用 OpenCode 蒸馏微调 Qwen3.5-4B 智能体
NielsRogge · x · 2026-08-10
开发者分享了一个周末实践项目:利用 OpenCode 工具包提取 GLM-5.2 的运行轨迹,并以此作为训练数据,通过 Q-LoRA 进行 SFT(监督微调),成功将能力蒸馏到 40 亿参数的 Qwen3.5 模型中。
由于模型是针对特定工具集训练的,它学会了直接调用 OpenCode 的内置工具。目前仅使用了 SFT,尚未引入 RL(强化学习)。微调后的模型已部署在 Hugging Face 的推理端点上。
「编程与Agent」频道最新
- 开发者吐槽:如果你还在乎代码质量,那就不是 Vibe Coding — haydendevs · 2026-08-10
- Scale AI 创始人:多智能体已能自主寻找 0-day 漏洞 — alexandr_wang · 2026-08-10
- 避免自动回复 Agent 陷入死循环的工程实践 — kumard3 · 2026-08-10
- 用 TRL 与 OpenCode 在远程沙箱中训练 AI 编程智能体 — NielsRogge · 2026-08-10
- 盘点 13 个值得关注的 AI Agent 开源框架与 SDK — TheTuringPost · 2026-08-10
- Meta 编程智能体亏本定价:以极低价格换取训练数据 — shashib · 2026-08-10