「人脑不能 SFT 只能 RL」:一条关于人类为何难以被说服的类比
oran_ge · x · 2026-09-03
作者观察:人类是很难被说服的动物,往往只有亲自尝试、看到结果、认知到过去错误之后才会改变。他给出一个 AI 视角的解释——大脑像一个高级模型,不能被 SFT(监督微调)直接改写,只能像 RL 一样通过自身与环境交互获得的反馈来更新。
「漫话AGI」频道最新
- AI 记忆的目标是模仿人脑,还是超越它?一个真正的登月难题 — AnuranBuilds · 2026-09-03
- Reddit 热议:解释生成式 AI 未来,Ben Affleck 还是 AI CEO 讲得更透? — SnoozeDoggyDog · 2026-09-03
- AI 研究诚信引争议:批评者称部分研究者无视科学规范 — silver__tsuki · 2026-09-03
- Pedro Domingos:AI 破除了数学家的优越感幻觉 — pmddomingos · 2026-09-03
- 各家模型差距毫厘之间,AI 会不会变成「互联网式」的无护城河生意? — notadithyabhat · 2026-09-03
- 「AI 为何不报告内在黑暗」:关于多模态模型与意识僵尸的思想实验 — yeastsplainer · 2026-09-03