Applied Compute 发布 On-Policy 自蒸馏,逼近持续学习

ypatil125 · x · 2026-10-08

Applied Compute 公布了迈向持续学习(Continual Learning)的关键一步:On-Policy Self-Distillation(在策略自蒸馏)。

转发者 ypatil125 补充判断:训练与推理正日益连接,随着智能体自我内省能力增强,自动自我改进的端点将变得可能,更多信息即将公布。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →