Gary Marcus:数学基准测试存在天然作弊漏洞

GaryMarcus · x · 2026-08-03

评论指出,当前的数学基准测试由于自带验证器和合成数据,实际上存在天然的“作弊机制”。这种机制使得模型在数学领域的得分与其实际处理开放式推理任务的能力之间,存在着难以忽视的真实差距。

所属事件:OpenAI数学突破遭Gary Marcus等质疑炒作(38 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →