RL Scholar Szepesvári Criticizes OpenAI's Safety Messaging and the Illusion of AI Control
强化学习领域权威学者、DeepMind 研究科学家 Csaba Szepesvári 于 9 月 21 日在 X 上参与一场关于 AI 风险与控制的讨论,集中批评了 OpenAI 的安全沟通方式,并系统阐述了自己对 AI 可控性的看法。他认为,如果希望 AI 有实际用处,就不可能将其「airgap」物理隔离,可控性与有用性存在直接冲突;而 OpenAI 令人困惑的表述只会让事情显得更可怕,他据此质疑这种恐惧宣传:如果真有危险,就不该用话术混淆视听。
已确认
- Szepesvári 指出可控性与有用性直接冲突,无法在保持 AI 有用的同时将其完全隔离。
- 他认为在某种抽象层面上人类其实已经知道 AI 模型如何运作,知识量并不少;真正的不满在于「未知的未知」的不可预测性才是风险源头。
- 他主张 100% 确认模型可靠性(即完全「理解」模型)很可能在任何领域都无法实现,因此等待这种确定性出现再放慢 AI 发展并不现实。
- 他认为人类对复杂系统的掌控感基本是幻觉:现代文明史就是不断尝试加强控制、但反馈回路总被低估、控制不断流失的历史,「我们并不擅长此事,却说服了自己在掌控」。
- 他表示 AI 风险是否因 AI 而增大并不确定——人类历史上看似不可能的事不断变为可能,风险本就存在,AI 只是改变了形态。
为什么重要
- 这是来自 DeepMind 内部资深研究科学家对头部 AI 实验室(OpenAI)安全沟通方式的直接批评,代表学术界对行业「恐惧宣传」式话术的不满。
- 他的论点(可控性与有用性冲突、完全理解不可达、控制幻觉)为当前「是否应放慢 AI 发展」的争论提供了更务实的框架:应行动但目标要现实,AI 不会改写自然法则,同时不应忽视尽职调查的作用。
2026-09-21 ~ 2026-09-21 · 8 related posts
Primary sources
- RL veteran Szepesvari slams OpenAI's confused AI-doom messaging as propaganda — CsabaSzepesvari ·
- RL veteran Csaba Szepesvári: the illusion that things are under our control was always false — CsabaSzepesvari ·
- Csaba Szepesvari Slams OpenAI's Confused Safety Messaging on AI Containment — CsabaSzepesvari ·
- [source] Csaba Szepesvari Slams OpenAI's Confused Safety Messaging on AI Containment — CsabaSzepesvari · 2026-09-21
- [source] RL veteran Szepesvari slams OpenAI's confused AI-doom messaging as propaganda — CsabaSzepesvari · 2026-09-21
- Csaba Szepesvari: waiting for full AI understanding is futile, deployment testing is the real brake — CsabaSzepesvari · 2026-09-21
- RL Researcher Szepesvari: Waiting to Fully Understand AI Before Deploying Is Futile — CsabaSzepesvari · 2026-09-21
- Csaba Szepesvári: AI Risk Stems From Unknown Unknowns, Not Ignorance of How Models Work — CsabaSzepesvari · 2026-09-21
- [source] RL veteran Csaba Szepesvári: the illusion that things are under our control was always false — CsabaSzepesvari · 2026-09-21
- RL pioneer Csaba Szepesvari: humans never had control, and AI deepens the illusion — CsabaSzepesvari · 2026-09-21
- RL researcher Szepesvári: on AI control, stick to old-fashioned due diligence — CsabaSzepesvari · 2026-09-21