新论文 Where-OPD:让自蒸馏教师知道「该往哪看」而非看得更清

abursuc · x · 2026-10-06

sophiasirko 发布新论文 Where-OPD。在 on-policy 自蒸馏中,学生模型从一个「特权版」的自己那里学习;近期方法的特权通常来自对图像的更好视角(更清晰的输入)。Where-OPD 提出反问:如果特权不是看得更清楚,而是教师知道该往哪里看呢?即将注意力位置本身作为特权信息的来源。更多细节见原线程。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →