「人脑不能 SFT 只能 RL」:一条关于人类为何难以被说服的类比

oran_ge · x · 2026-09-03

作者观察:人类是很难被说服的动物,往往只有亲自尝试、看到结果、认知到过去错误之后才会改变。他给出一个 AI 视角的解释——大脑像一个高级模型,不能被 SFT(监督微调)直接改写,只能像 RL 一样通过自身与环境交互获得的反馈来更新。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →