LLM 本质:概率引导的组合空间搜索,数据盲区是软肋

AlexTensor · x · 2026-09-22

讨论者认为 LLM 的条件概率模型 P(X|previous tokens) 是在组合 token 空间中引导搜索过程的向导,再通过各种采样策略选出下一个 token。核心问题在于:当训练数据覆盖不足时,P() 的可靠性会崩塌。引用者将 agent 使用工具类比为 A 图遍历加决策树——只是把「最低成本」换成「从观察人类使用中学到的概率」,并认为这并非对概念的真正理解。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →