预测下一个token不代表缺乏理解,理解源于架构本身

burny_tech · x · 2026-08-29

针对“只是预测下一个 token 所以无法理解”的质疑,作者反驳称预测只是目标函数,理解过程发生在架构内部。理论上完美的预测器可能需要模拟万物,正如人类在做填空任务时会运用理解能力。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →