学者批强化学习无法实现道德对齐:条件反射等同惩罚

examachine · x · 2026-08-11

作者对当前主流的 AI "对齐" 方法提出批评,认为其底层逻辑存在根本缺陷。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →