前沿模型数学能力超人类?研究员呼吁量化超人基准

mmitchell_ai · x · 2026-07-21

AI 研究员 Margaret Mitchell 指出,当前的前沿大模型在某些历史上有极高声望的数学任务上,已经明显展现出超越人类的能力。

她进一步提出一个设想:可以通过组织数学家开展集中式的工作坊(例如为期 6 周的协作攻关),来尝试解决诸如雅可比猜想等难题。通过记录人类数学家解决特定问题所需的人数(N)和小时数(K),并与 AI 模型(如 Fable)所需的时间进行对比,我们或许能借此更清晰、具体地量化所谓的“超人”究竟意味着什么。

所属事件:前沿模型数学能力被指超越人类,专家探讨量化基准(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →