研究揭示 LLM 在线蒸馏的泛化双重性

IQuestLab · hf · 2026-08-24

该研究探讨了大模型在线策略蒸馏的泛化机制。发现蒸馏主要转移推理行为而非具体答案,且泛化能力高度依赖于师生模型的来源对齐;同时,使用多教师组合会导致模型能力的权衡。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →