微软研究院:弱模型也能蒸馏出更强学生模型

MicrosoftResearch · hf · 2026-08-04

微软研究院提出 Weak-to-Strong On-Policy Distillation(W2S-OPD),试图解决“没有更强 teacher 时,如何继续提升强学生模型”的问题。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →