神经科学家 Kording:RLHF 抹去了 AI 回复中「想法真正来源」
KordingLab · x · 2026-09-12
计算神经科学家 Konrad Kording(KordingLab)提出一个关于 AI 归因的观察:AI 会把功劳归于某个发明的发明者,却几乎从不归功于想法的真正来源(那些提出了雏形但没做成的人)。更奇怪的是,用户看到的「解释自己想法」的沟通模式其实有原始出处,但 RLHF 把它抹掉了——因为用户更愿意相信这是自己的主意、自己的清晰表达,而科学界也没有办法去追究这一点。
所属事件:神经科学家称 RLHF 抹去了 AI 回答中观点的真正来源(2 条相关)→
「漫话AGI」频道最新
- 用 Agent 跑攻击脚本免责?作者称责任不应改变 — gerardsans · 2026-09-12
- DeepMind 联合哈佛斯坦福发文:视觉 AI 或是通往 AGI 的路径 — rohanpaul_ai · 2026-09-12
- 桑德斯抨击马斯克:曾称 AI 比核武危险,如今说警告是设局 — RazRazcle · 2026-09-12
- 用挖洞机反讽 OpenAI:88 小时算力=600 博士一年经费 — arampell · 2026-09-12
- 「Lee Sedol 时刻」:研究者担忧 AI 已可像博士后一样放手自跑 — IgorCarron · 2026-09-12
- 前 DeepMind 研究负责人 Vinyals:AI 自我改进将至,但不会智能爆炸 — The Decoder · 2026-09-12