受控实验:LLM 难以恢复潜在序列结构,长上下文也无济于事

illinois · hf · 2026-10-09

伊利诺伊大学一项受控研究检验 LLM 能否超越表面动作频率、恢复潜在序列结构——这对行为模拟至关重要。实验采用双人「石头剪刀布」交互与单人随机 n-gram 续写任务,区分「分布匹配」与「条件规则遵循」。

核心发现:更长的上下文并不能提升对潜在策略的识别;正确识别策略也不保证能忠实模拟;高阶条件依赖会显著恶化规则恢复。结论是,表面行为保真可能掩盖错误的生成机制,对用 LLM 做行为模拟器是重要警示。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →