EMNLP 2026 paper RECAP trains reasoning models to recover from unsafe trajectories

pinyuchenTW · x · 2026-10-08

The EMNLP 2026 main-conference paper RECAP studies how flawed reasoning undermines model safety and trains reasoning models to recognize, override, and recover from unsafe trajectories. The team notes frontier labs talk more about safety than ever while shipping faster — they don't release frontier models but take their safety seriously. An explainer video accompanies the paper.

Original post →

More from Safety

Safety channel →