Agent-G²: Gaussian Guidance for Long-Horizon RL

ZhejiangUniversity · hf · 2026-08-27

Agent-G² models hint depth as a Gaussian distribution estimated online from existing rollouts. This approach improves reinforcement learning performance on long-horizon tasks without requiring extra probing.

Original post →

More from Research

Research channel →