EMNLP 论文:LLM 数学推理缺乏类人知识结构,评测指标看不见缺陷

rohanpaul_ai · x · 2026-09-12

arXiv 论文《Do LLMs Exhibit Coherent Knowledge Structures in Mathematical Reasoning? A Perspective from Knowledge Space Theory》(EMNLP 2026 findings),作者 Peng Cui、Heejin Do、Mrinmaya Sachan,用知识空间理论(KST)框架评估 8 个开源与闭源 LLM 并与真实人类学习者对比。

核心发现:

结论:行为层面证明当前 LLM 的知识不具备类人结构;高准确率可能掩盖割裂的知识孤岛,评估推理模型应使用关联的简单/困难题组而非孤立 benchmark 题。

所属事件:研究发现大模型数学推理缺乏类人知识结构(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →