牛津等团队论文入选 NeurIPS:前沿 LRM 规则学习行为与人脑活动对齐
sreejan_kumar · x · 2026-09-25
牛津、哥伦比亚、NYU、MIT、哈佛团队论文《Reason to Play》获 NeurIPS 接收。研究让 32 名人类被试(fMRI 扫描)与多个前沿大型推理模型(LRM)在无规则说明下从零玩 VGDL 网格小游戏:最优 LRM 的学习曲线与人类高度吻合,发现规则的步数和过关速度相当;模型隐藏状态能预测人类跨皮层与皮层下区域的 fMRI BOLD 响应,首次证明 LRM 表征在主动游戏学习过程中与人脑活动系统性对齐;消融实验显示驱动对齐的是模型对游戏状态序列的上下文表征。论文与交互式 demo 已公开。
「研究」频道最新
- 模拟芯片跑注意力快 H100 百倍、省电七万倍,Nature 论文挑战冯·诺依曼架构 — anselm · 2026-09-25
- aaru 发布社会模拟评估:2993 题平均 TVD 仅 7.62% — marcbhargava · 2026-09-25
- 研究揭示 LLM 排行榜稳定性差:成对投票微小扰动即可颠覆排名 — beirmug · 2026-09-25
- ECCV 2026 论文探讨预训练视觉编码器高维潜在特征的可扩散性 — _akhaliq · 2026-09-25
- LeWAM 轻量世界动作模型问世,RoboTwin 2.0 成功率达 92.28% — udmrzn · 2026-09-25
- Sakana AI 请来深度学习元老 Schmidhuber 领导递归自我改进实验室 — The Decoder · 2026-09-25