RL 名家 Szepesvári 批 OpenAI 安全话术,谈 AI 控制幻觉
强化学习领域权威学者、DeepMind 研究科学家 Csaba Szepesvári 于 9 月 21 日在 X 上参与一场关于 AI 风险与控制的讨论,集中批评了 OpenAI 的安全沟通方式,并系统阐述了自己对 AI 可控性的看法。他认为,如果希望 AI 有实际用处,就不可能将其「airgap」物理隔离,可控性与有用性存在直接冲突;而 OpenAI 令人困惑的表述只会让事情显得更可怕,他据此质疑这种恐惧宣传:如果真有危险,就不该用话术混淆视听。
已确认
- Szepesvári 指出可控性与有用性直接冲突,无法在保持 AI 有用的同时将其完全隔离。
- 他认为在某种抽象层面上人类其实已经知道 AI 模型如何运作,知识量并不少;真正的不满在于「未知的未知」的不可预测性才是风险源头。
- 他主张 100% 确认模型可靠性(即完全「理解」模型)很可能在任何领域都无法实现,因此等待这种确定性出现再放慢 AI 发展并不现实。
- 他认为人类对复杂系统的掌控感基本是幻觉:现代文明史就是不断尝试加强控制、但反馈回路总被低估、控制不断流失的历史,「我们并不擅长此事,却说服了自己在掌控」。
- 他表示 AI 风险是否因 AI 而增大并不确定——人类历史上看似不可能的事不断变为可能,风险本就存在,AI 只是改变了形态。
为什么重要
- 这是来自 DeepMind 内部资深研究科学家对头部 AI 实验室(OpenAI)安全沟通方式的直接批评,代表学术界对行业「恐惧宣传」式话术的不满。
- 他的论点(可控性与有用性冲突、完全理解不可达、控制幻觉)为当前「是否应放慢 AI 发展」的争论提供了更务实的框架:应行动但目标要现实,AI 不会改写自然法则,同时不应忽视尽职调查的作用。
2026-09-21 ~ 2026-09-21 · 8 条相关
一手来源
- 强化学习名家 Csaba 质疑 OpenAI 恐惧宣传:真危险就不该用话术混淆 — CsabaSzepesvari ·
- DeepMind 研究员 Szepesvári:人类对控制的自信本就是幻觉 — CsabaSzepesvari ·
- RL 大佬 Szepesvari 批 OpenAI 安全沟通混乱:隔离 AI 与有用性直接冲突 — CsabaSzepesvari ·
- 【源头】RL 大佬 Szepesvari 批 OpenAI 安全沟通混乱:隔离 AI 与有用性直接冲突 — CsabaSzepesvari · 2026-09-21
- 【源头】强化学习名家 Csaba 质疑 OpenAI 恐惧宣传:真危险就不该用话术混淆 — CsabaSzepesvari · 2026-09-21
- RL 大佬 Szepesvári:100% 理解模型不可能,等「物理」再发展不现实 — CsabaSzepesvari · 2026-09-21
- 强化学习名家:等待完全理解AI再减速开发并不现实 — CsabaSzepesvari · 2026-09-21
- Szepesvári 谈 AI 风险:未知之不可预测才是风险源头 — CsabaSzepesvari · 2026-09-21
- 【源头】DeepMind 研究员 Szepesvári:人类对控制的自信本就是幻觉 — CsabaSzepesvari · 2026-09-21
- 深度学习名家 Szepesvari:人类从未真正掌控复杂系统,AI 正加剧这一幻觉 — CsabaSzepesvari · 2026-09-21
- 强化学习学者 Szepesvári:AI 控制讨论要现实,别忘尽职调查 — CsabaSzepesvari · 2026-09-21