无需外部监督,新方法实现大模型自我蒸馏纠错

UCSanDiego · hf · 2026-08-12

UC SanDiego 发布了一项新研究,提出了一种无监督的在线策略自我蒸馏方法。

该方法利用模型内部的一致性和多数投票产生的伪解决方案,在没有外部监督的情况下,能够纠正大语言模型中自信但错误的输出,从而提升模型整体能力。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →