Ex-OpenAI Researcher Lukasz Kaiser Bids Farewell to RLSlow Team

Former OpenAI researcher Lukasz Kaiser penned a farewell to the RLSlow team, recounting how reinforcement-learning-based "slow thinking" for language models grew from a belief into a scaled-up reality.

2026-09-07 ~ 2026-09-07 · 2 related posts