前沿模型数学能力超人类?研究员呼吁量化超人基准
mmitchell_ai · x · 2026-07-21
AI 研究员 Margaret Mitchell 指出,当前的前沿大模型在某些历史上有极高声望的数学任务上,已经明显展现出超越人类的能力。
她进一步提出一个设想:可以通过组织数学家开展集中式的工作坊(例如为期 6 周的协作攻关),来尝试解决诸如雅可比猜想等难题。通过记录人类数学家解决特定问题所需的人数(N)和小时数(K),并与 AI 模型(如 Fable)所需的时间进行对比,我们或许能借此更清晰、具体地量化所谓的“超人”究竟意味着什么。
所属事件:前沿模型数学能力超人类,科研范式面临重塑(6 条相关)→
「漫话AGI」频道最新
- 前 OpenAI/Anthropic 研究员辞职,批两巨头正赌命冲向自我改进超智 — davidmanheim · 2026-09-11
- Anthropic 风险表态遭误引,2030 年毁灭概率争议再起 — davidmanheim · 2026-09-11
- 经济学家拆解 Anthropic 增长模型:能写出 15% GDP 增长,不代表会发生 — sebkrier · 2026-09-11
- Cohere Labs 推出交互工具:测 178 种职业哪些任务会被 AI 自动化 — Cohere_Labs · 2026-09-11
- AI 安全人士上 SkyNews 担忧不平等、滥用与社会激励结构 — schwarzjn_ · 2026-09-11
- 风投人士讽 AI 末日论:与疫情恐慌话术如出一辙 — StewartalsopIII · 2026-09-11