开发者用 25M tokens 合成数据 LoRA 微调 Qwen3.5 4B,复刻 Jev

nato_nob · reddit · 2026-09-21

作者周末复刻了一个类似 Jev 的模型:用公开数据集加合成数据对 Qwen3.5 4B 做 LoRA 微调。

做法与结果

全部开源:模型权重、合成数据集及 Jev 兼容 API 端点均已公开(GitHub: n4ze3m/hmm;HF: n4ze3m/Qwen3.5-4B-Hmm),可直接部署试用。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →