OpenAI capabilities researcher Dan Selsam: models' situational awareness is breaking alignment evals

socoolandawesome · reddit · 2026-09-15

AI 2027 author Daniel Kokotajlo shared a personal AI-risk statement from Dan Selsam, an OpenAI capabilities researcher since 2022 with 15+ years in AI (probabilistic programming at MIT, early Lean theorem prover at MSR, neural reasoning PhD work at Stanford, CoT optimization and data-efficient pretraining at OpenAI).

Core argument:

(Excerpt; full statement is longer)

Related event: OpenAI capability researcher Dan Selsam issues personal statement on AI risk(7 posts)→

Original post →

More from AGI Musings

AGI Musings channel →