北大开源教育基础模型 OmniEdu,按四种能力组织训练数据
PekingUniversity · hf · 2026-09-22
北京大学发布开源教育基础模型系列 OmniEdu,面向 K-12 学习与教学场景,同时覆盖解题、课程理解、学情诊断与教学辅导,而非以往只侧重单一任务的模型。
- 训练数据整合 100+ 教育资源与通用指令源,围绕学科能力、课程对齐、诊断推理、教学行动与脚手架四种能力组织,产出 69,999 条样本、约 1596 万监督 tokens
- 数据管线包括确定性清洗、语义审校改写、任务质量打分与 token 预算下的多样性筛选
- 微调了 4B、9B、27B 三个规模;OmniEdu-27B 在 K12-Bench 达 63.12% EM / 76.69% F1,MathFish 85.89%,EDUMATH 86.95%,MathTutorBench Scaffold 设定 78.74%,并在 LongTutor 教学维度拿到最高 3.02 分
- 结果表明按能力均衡组织的监督数据能有效将通用模型适配到教育任务
「模型」频道最新
- EEBench 对比引热议:Grok 4.7 被指产出“无法审查的电路垃圾” — teortaxesTex · 2026-09-22
- 爆料称 OpenAI 新智能体命名为 Aeon,或周四上线对标 Grok Bot — ZeroStateReflex · 2026-09-22
- 实测打脸:Grok 4.7 每任务 token 反而少 46% — ns123abc · 2026-09-22
- 研究者类比:研究 LLM 心理学像 1850 年研究人类心理 — repligate · 2026-09-22
- Meta 发布 SAM 3.1 分割模型,网友演示用它做 GIF — Necessary-Garlic-704 · 2026-09-22
- 开源模型 Laya 首版仅训练 15 小时即上线 HF 与 GitHub — NirantK · 2026-09-22