新研究:语言模型在推理任务上呈现与人类相似的内容效应
AndrewLampinen · x · 2026-10-06
Andrew Lampinen 宣布其预印本《Language models show human-like content effects on reasoning tasks!》发布大幅更新版本。核心发现:逻辑题目的内容本身会影响解答正确率,而语言模型与人类在这一模式上呈现出惊人的相似性。作者还补充了两条延伸讨论:一是内容对推理影响的更多实验结果,二是如何用「数据增强」的视角来解读海马体在泛化中的贡献。这为「LLM 是否真正推理」的争论提供了新的实证参照——如果模型与人类同样被题目表层内容干扰,说明两者的推理机制可能有共同的结构性局限。
「研究」频道最新
- 研究员携隐性课程假设与 HalluWorld 基准亮相 COLM 2026 并找工作 — dan_fried · 2026-10-06
- OffensiveAIcon 大会看点:ExploitBench 基准与全自动 HTTP 攻击级联 — dyn___ · 2026-10-06
- X-Tree 论文:零 LLM 调用挖掘轨迹技能树,训练数据、奖励、上下文三用 — hllo_wrld · 2026-10-06
- 扰动模型难泛化的两大瓶颈:系统表征与信号识别 — yusufroohani · 2026-10-06
- CivBench 让 LLM 打文明 V:GLM-5.3 胜过 Opus-5.5 — vox-deorum · 2026-10-06
- Apple 研究员两篇流模型论文中选 NeurIPS,提出轨迹归一化模型 — thoma_gu · 2026-10-06