LLM 本质:概率引导的组合空间搜索,数据盲区是软肋
AlexTensor · x · 2026-09-22
讨论者认为 LLM 的条件概率模型 P(X|previous tokens) 是在组合 token 空间中引导搜索过程的向导,再通过各种采样策略选出下一个 token。核心问题在于:当训练数据覆盖不足时,P() 的可靠性会崩塌。引用者将 agent 使用工具类比为 A 图遍历加决策树——只是把「最低成本」换成「从观察人类使用中学到的概率」,并认为这并非对概念的真正理解。
「研究」频道最新
- 俄勒冈州立团队让多台人形机器人协作夹取搬运,无通信单策略 — tweetsatpreet · 2026-09-22
- 14 个用例复现完整榜单:Terminal Bench Mini 加速本地模型评测 — asankhs · 2026-09-22
- 模型嫁接:把 Qwen3.5-4B 事后改造成因果 encoder-decoder,提速最高 3.7 倍 — asankhs · 2026-09-22
- SteerDuplex:全双工语音对话模型可控性提升 44.5 个百分点 — ScaleAI · 2026-09-22
- 假投稿疑集中少数大学,研究者提议限制作者投稿数 — sarahookr · 2026-09-22
- rollout 调度成推理效率杠杆,网友热议论文公开指标 — stochasticchasm · 2026-09-22