观点:LLM 使用像永不回溯的 MCMC

网友 @TricklerHQ 提出类比:当前 LLM 的使用像一个奖励驱动的随机过程(类似 MCMC),每一步 prompt 都在向更高「能量状态」爬升却从不回溯。相关讨论还认为,语言模型永远需要某种形式的 Harness,因为模型本身没有感官和能力,不断修正 prompt 恰恰说明模型还不够好。

2026-08-25 ~ 2026-08-25 · 3 条相关