受控实验:LLM 难以恢复潜在序列结构,长上下文也无济于事
illinois · hf · 2026-10-09
伊利诺伊大学一项受控研究检验 LLM 能否超越表面动作频率、恢复潜在序列结构——这对行为模拟至关重要。实验采用双人「石头剪刀布」交互与单人随机 n-gram 续写任务,区分「分布匹配」与「条件规则遵循」。
核心发现:更长的上下文并不能提升对潜在策略的识别;正确识别策略也不保证能忠实模拟;高阶条件依赖会显著恶化规则恢复。结论是,表面行为保真可能掩盖错误的生成机制,对用 LLM 做行为模拟器是重要警示。
「研究」频道最新
- LOCUS:用 token 子空间定向选择注意力头做激活转向 — FrancescoLocat8 · 2026-10-09
- AI训练中是否存在主观体验?研究者争论前向与反向传播的qualia概率 — Sauers_ · 2026-10-09
- Deedy 称人类已实现 AGI:LLM 在 7 个千禧年难题中 4 个取得实质进展 — FinanceYF5 · 2026-10-09
- OpenAI数学成果震动学界,百位数学家写下反思与回应 — keviv9 · 2026-10-09
- MOSS 研讨会落地 COLM:探讨小算力学术研究如何做贡献 — AdtRaghunathan · 2026-10-09
- NVIDIA 团队新论文:从基座模型预测后训练后编程 Agent 表现 — heghbalz · 2026-10-09