开发者用 25M tokens 合成数据 LoRA 微调 Qwen3.5 4B,复刻 Jev
nato_nob · reddit · 2026-09-21
作者周末复刻了一个类似 Jev 的模型:用公开数据集加合成数据对 Qwen3.5 4B 做 LoRA 微调。
做法与结果
- 合成数据由 DeepSeek V4.1 Flash 生成,约 2500 万 tokens。
- 在租用的 RTX 3090 上训练约 2 小时。
- typed-decisions 基准从基座的 0.596 提升至 0.709;距真正的 Jev 仍有差距,但明显强于基座。
全部开源:模型权重、合成数据集及 Jev 兼容 API 端点均已公开(GitHub: n4ze3m/hmm;HF: n4ze3m/Qwen3.5-4B-Hmm),可直接部署试用。
「编程与Agent」频道最新
- 实测模型路由多智能体组合:成本接近 Astra 单模型还跑不完任务 — kevinkern · 2026-09-21
- Agent 该配守护 Agent 吗:延迟与实现位置之争 — BlueberryOk8225 · 2026-09-21
- 开源项目:把 Perplexity 做成 ChatGPT 可用的 MCP — Sensitive-Priority59 · 2026-09-21
- 开源 Jev 76 秒分拣 1000 封 Gmail,全程只花 3 美分 — _AustinCalvert_ · 2026-09-21
- 租前沿、守地板:被关门前你要拥有什么 — ccerrato147 · 2026-09-21
- jev-mcp-spring:TypeSafe Jev 的 Java MCP 服务器发布 — Aggravating_Kale7895 · 2026-09-21