Freeform Preference Learning Defines Robot Rewards in Natural Language

Marcel Torne, Chelsea Finn and colleagues propose freeform preference learning, which defines reward axes via natural language, boosting robotic manipulation performance by 38 percentage points over sparse binary or trajectory preference signals.

2026-09-09 ~ 2026-09-10 · 2 related posts