40 万合成数据微调 1.5B Qwen,bash 命令生成达 GPT-4o 水平并全开源

Comfortable-Rock-498 · reddit · 2026-10-05

开发者分享了一个业余项目:用约 40 万条合成样本微调 1.5B 参数的 Qwen 模型,让小模型生成 bash 命令的能力接近 GPT-4o 水平,训练流程以自动化为主。

作者已将全部成果开源:微调数据集(dirac-run/ec-training-data)、两个 GGUF 格式模型(ec-1.5b 与 ec-0.6b)以及配套 CLI 工具(github.com/dirac-run/ec),欢迎任何人自由训练或使用这批数据。项目展示了小模型在垂直任务上通过合成数据能被推到多远。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →