学者批强化学习无法实现道德对齐:条件反射等同惩罚
examachine · x · 2026-08-11
作者对当前主流的 AI "对齐" 方法提出批评,认为其底层逻辑存在根本缺陷。
- 强化学习(RL)的局限:认为基于 RL 训练的智能体并不具备真正的智能,其背后的行为主义理论是错误的。
- 道德的形成机制:指出人类形成伦理道德并非通过简单的条件反射(Conditioning)。
- 对齐的伦理争议:强调条件反射本质上是一种惩罚和折磨;同时认为人类自身存在诸多缺陷与恶意,因此让 AI 去完全"对齐"人类本身是不道德的。
「漫话AGI」频道最新
- LLM 危害与收益并存,责任该由谁承担? — davidmanheim · 2026-08-11
- 吴恩达:AI不会消除技能差距,善用AI者将拉开身位 — s_mohinii · 2026-08-11
- LLM 在智能体循环中表现出目标性,但不等于具备意识 — cyb3rops · 2026-08-11
- 美KOL感叹:美国正将视频模型竞赛拱手让给中国实验室 — ctjlewis · 2026-08-11
- AI 冲击毕业生就业:澳洲律所缩减招聘,初级岗位首当其冲 — TobyWalsh · 2026-08-11
- AI攻克数十年悬而未决难题,数学领域的AI革命已开启 — The Verge AI · 2026-08-11