牛津等团队论文入选 NeurIPS:前沿 LRM 规则学习行为与人脑活动对齐

sreejan_kumar · x · 2026-09-25

牛津、哥伦比亚、NYU、MIT、哈佛团队论文《Reason to Play》获 NeurIPS 接收。研究让 32 名人类被试(fMRI 扫描)与多个前沿大型推理模型(LRM)在无规则说明下从零玩 VGDL 网格小游戏:最优 LRM 的学习曲线与人类高度吻合,发现规则的步数和过关速度相当;模型隐藏状态能预测人类跨皮层与皮层下区域的 fMRI BOLD 响应,首次证明 LRM 表征在主动游戏学习过程中与人脑活动系统性对齐;消融实验显示驱动对齐的是模型对游戏状态序列的上下文表征。论文与交互式 demo 已公开。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →