SimpleOPD 提升短上下文模型数学与科学推理
Shanghai-AI-Laboratory · hf · 2026-08-17
上海 AI 实验室提出 SimpleOPD,一种简单的与分词器无关的在线策略蒸馏方法。该方法将长上下文推理教师模型蒸馏到短上下文学生模型,通过对齐 token 跨度、约束长度增长和稳定训练,显著提升了数学证明推理能力并泛化至科学基准测试。
「研究」频道最新
- 迈向通用科学 AI:多模态科学图像理解新基准 — SciKnowOrg · 2026-08-17
- 主观逻辑:不确定条件下推理的形式化体系专著回顾 — FrnkNlsn · 2026-08-17
- 蛋白互作预测:简单方法在已知蛋白上效果极佳 — anshulkundaje · 2026-08-17
- ML 科学领域复现危机严重:32 种 PPI 方法仅 7 个可复训 — anshulkundaje · 2026-08-17
- 新论文破解基于序列的蛋白质互作预测黑盒 — anshulkundaje · 2026-08-17
- 中国脑读 AI 模型或可提前 4 年预测抑郁症风险 — Affectionate_Bee6434 · 2026-08-17