Research Discusses Improving Pre-trained GCRL Policies

Recent research focuses on improving pre-trained GCRL policies by integrating planning with learned policies, sharing similarities with SPTM. The contribution lies in instantiating this concept using a value-based distance function to enhance existing models.

2026-07-09 ~ 2026-07-10 · 4 related posts