万字长文:LLM 只在做猜下一个词,智能为何能「掉出来」
r0ck3t23 · x · 2026-09-08
一篇广为传播的解释性长文,从「所有大模型都在做同一件事——预测下一个词」出发,阐述知识如何作为更好预测的副产品从中涌现:要猜对推理小说的下一个词就得记住谁在房间里,要补全代码就得理解上面的函数,要接上「太阳下的冰」就需要近似物理的东西。
作者用「装满调光旋钮的房间」类比模型参数:cook 与 turkey 经常相邻所以权重高,kill 与 spider 的含义取决于上下文;训练就是数万亿次「预测—对答案—微调旋钮」。同一机制也解释了幻觉(完全符合模式却指向不存在之物)与偏见(系统忠实复现人类模式,包括不愿复现的那些)。文末指出这是否算「理解」尚无定论,但人类几乎所有思考都以文字留下痕迹,世界的结构一直藏在这些被写下的句子里,而相当一部分所谓思考,确实能从思考留下的残骸中恢复。
「漫话AGI」频道最新
- Astra 引发存在焦虑:教育、学历与智力的价值被重新审视 — dr_alphalyrae · 2026-09-08
- 用未来流动性抵押借款,尽快投入 AI 安全事业 — connoraxiotes · 2026-09-08
- Gemini 前高管:会提示词的创作者有一年窗口期建立新帝国 — gabriel1 · 2026-09-08
- 作者提出 AGI 命运第三选项:文明与生态随 AGI 共同演化 — danfaggella · 2026-09-08
- 今年科技业已裁 12.4 万人,「学编程」叙事终结但 CS 未死 — _akpiper · 2026-09-08
- AI 对齐之争:光靠贴「英语宪法」不够,要从训练数据就建模伦理结构 — GlenBradley · 2026-09-08