Lightning Weave:能力组合蒸馏同提推理准确率与 token 效率
Yecheng Wu · hf · 2026-09-16
新方法 Lightning Weave 通过 on-policy 蒸馏,把多个独立训练的推理能力组合进单个高效学生模型,在数学与代码基准上同时提升准确率和 token 效率。
「研究」频道最新
- Aaronson 爆料:AI 公司疑解出理论计算机科学多个开放难题 — QuintinPope5 · 2026-09-16
- 随机对照试验:LLM 未显著提升新手湿实验生物操作成功率 — shae_mcl · 2026-09-16
- scvi-tools 发布六年仍被广泛使用,扛住基础模型与编码智能体冲击 — anshulkundaje · 2026-09-16
- 丹麦行政数据研究:AI 对收入和工资「无影响」 — paulnovosad · 2026-09-16
- Zero 智能体用「会对话的模拟角色世界」合成数据训练 — generativist · 2026-09-16
- NeurIPS 论文:Newcomb 类环境中 RL 智能体可能无法收敛到最优策略 — jessi_cata · 2026-09-16