Matt Lutz 长文:AI 对齐在理论上就不可能,应停止开发
GregoryConti19 · x · 2026-09-13
哲学家 Matt Lutz 在 Persuasion 发表文章《AI Alignment Is Impossible》,主张对齐不仅在实践上、在理论上都无法实现,人类应停止 AI 开发而非幻想安全对齐。
- 作者将「AI 不会毁灭人类」的可能归结为两个约束:能力约束(AI 没能力灭世)与道德约束(AI 有能力但选择不灭世),并认为随着 agentic AI 和代码能力爆发,能力约束正逐日削弱。
- 历经近半年能力跃升后,作者从怀疑存在性风险转为担忧,尤其担心 AI 自我改进代码引发指数级能力增长。
- 核心论点:既然无法保证 AI「对齐」于人类价值,继续开发强大 AI 就是在玩火,唯一负责任的选择是停下。
- 该文引发哲学家 Seth Lazar 的强烈反驳(见同线程),双方就「对齐是否可解」展开辩论。
所属事件:哲学家激辩「AI 对齐不可能论」,Seth Lazar 贴脸反驳(2 条相关)→
「漫话AGI」频道最新
- 观点:LLM 影响堪比印刷机,但要警惕「末日心理循环」 — teodorio · 2026-09-14
- 《Adolescence》编剧 Thorne 警告:同行正用 AI「作弊」写剧本 — nordicinst · 2026-09-14
- 选「AI 免疫」学位防失业?专家称不如培养可迁移技能 — nordicinst · 2026-09-14
- 致 OpenAI 与 Anthropic 的公开信:安全表态为何不等于安全领导力 — AryHHAry · 2026-09-14
- Muon 作者提「AI 安全悖论」:最促进安全的事件最难预测 — RichmanRonald · 2026-09-14
- 借电力改革思路,Reddit 用户提议建中立 AI 交换机打破头部实验室渠道垄断 — NewYak4281 · 2026-09-14