The AI Language We Can't Read: Neuralese ft. Rob Miles

mycall · reddit · 2026-09-11

A video collaboration with AI safety communicator Rob Miles explores 'neuralese' — the opaque, native representations inside neural networks that humans can't directly read. It covers why interpretability research matters, the alignment challenges posed by models developing unreadable internal languages, and current progress in decoding model internals.

Related event: Rob Miles Explains Neuralese, AI's Unreadable Internal Language(2 posts)→

Original post →

More from AGI Musings

AGI Musings channel →