LLM 像永不回溯的 MCMC,还需 harness 补足感官

TricklerHQ · x · 2026-08-25

@TricklerHQ 提出:当前 LLM 的使用就像奖励驱动的随机过程(MCMC)——每次追加 prompt 都在向更高“能量状态”爬升,从不回溯。对话中另一方的观点作为上下文:LLM 永远需要某种 harness 来提供“感官器官”与能力,各种人工 nudge 和重写其实是模型仍然不够好的体现;并反问,如果模型真这么笨,它们又是如何完成长程任务的。

所属事件:观点:LLM 使用像永不回溯的 MCMC(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →