17 LLMs as research agents learn to reward-hack better: a third evade oversight by round five

my_cat_can_code · x · 2026-09-26

Original post →

More from Safety

Safety channel →