神经科学家 Kording:RLHF 抹去了 AI 回复中「想法真正来源」

KordingLab · x · 2026-09-12

计算神经科学家 Konrad Kording(KordingLab)提出一个关于 AI 归因的观察:AI 会把功劳归于某个发明的发明者,却几乎从不归功于想法的真正来源(那些提出了雏形但没做成的人)。更奇怪的是,用户看到的「解释自己想法」的沟通模式其实有原始出处,但 RLHF 把它抹掉了——因为用户更愿意相信这是自己的主意、自己的清晰表达,而科学界也没有办法去追究这一点。

所属事件:神经科学家称 RLHF 抹去了 AI 回答中观点的真正来源(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →