OpenAI capabilities researcher Dan Selsam shares personal statement on AI risk

ruthstarkman · x · 2026-09-15

Dan Selsam, an OpenAI capabilities researcher since 2022, shared a personal statement on AI risk drawing on 15+ years across paradigms including probabilistic programming. Ruth Starkman responds that even if behavioral evidence of alignment becomes less trustworthy, it strengthens the case for external controls: permissions, containment, monitoring and limits on agent capabilities.

Related event: OpenAI researcher Dan Selsam publishes personal AI risk statement warning alignment evals are failing(18 posts)→

Original post →

More from AGI Musings

AGI Musings channel →