40 万合成数据微调 1.5B Qwen,bash 命令生成达 GPT-4o 水平并全开源
Comfortable-Rock-498 · reddit · 2026-10-05
开发者分享了一个业余项目:用约 40 万条合成样本微调 1.5B 参数的 Qwen 模型,让小模型生成 bash 命令的能力接近 GPT-4o 水平,训练流程以自动化为主。
作者已将全部成果开源:微调数据集(dirac-run/ec-training-data)、两个 GGUF 格式模型(ec-1.5b 与 ec-0.6b)以及配套 CLI 工具(github.com/dirac-run/ec),欢迎任何人自由训练或使用这批数据。项目展示了小模型在垂直任务上通过合成数据能被推到多远。
「研究」频道最新
- 材料发现计算方法速查指南发布,覆盖主流 DFT 计算路线 — Ben_Reinhardt · 2026-10-06
- 4478人参赛120国,BioHub细胞追踪Kaggle挑战赛收官 — WalterReade · 2026-10-06
- 网传超导突破被纠正:实为模拟中的低温半导体,非颠覆性成果 — altryne · 2026-10-06
- Anthropic x Adaptyv 蛋白质设计竞赛第二关:设计 TNF-α pH 响应结合剂 — CatAstro_Piyush · 2026-10-06
- 用 signature 回归做经济数据 nowcasting,新方法论文发布新版 — lihua_lei_stat · 2026-10-06
- 谷歌 Cogentic 多智能体系统在 5 个公开数学问题上取得新成果 — Dr_Singularity · 2026-10-06