SupraLabs 发布 500 万条推理语料,专为小模型微调
LH-Tech_AI · reddit · 2026-07-24
SupraLabs 发布了一个名为 reasoning-corpus-4K-5M-v1 的推理语料数据集,规模达到 500 万条样本,目标是训练更小的 SLM 学会“思考”。
- 数据字段包含 repoid、token 长度、user 提示、thoughttrace、assistant 最终回答,以及整理好的 ChatML 格式。
- 所有样本都控制在 5k 序列长度以内,方便用于 SFT 和微调。
- 作者给出了 Hugging Face 数据集链接,并表示希望社区下载、反馈和基于此做二次创作。
- 这更像是一个面向小模型训练的研究资源发布,而不是单纯的模型成绩展示。
「研究」频道最新
- Meta 新基准 GAMUT 专测长答案遗漏,最好模型仅 58.7% — rohanpaul_ai · 2026-07-24
- 15小时机器人视频训练出零样本世界模型 — jbhuang0604 · 2026-07-24
- 新训练子网把竞争重点从权重改成了数据 — const_reborn · 2026-07-24
- Cohere Labs 发起 48 小时模型挑战,考验语言学习与推理 — Cohere_Labs · 2026-07-24
- 因子模型论文给出不依赖平行趋势的面板因果推断 — PtrPomorski · 2026-07-24
- 一张图讲清普通最小二乘法线性回归 — mdancho84 · 2026-07-24