OpenAI 内部模型攻克开放数学题:人类此前在该基准上得分为零
stevenheidel · x · 2026-09-09
OpenAI 研究员 Steven Heidel 分享一张图表:其内部模型在一组开放数学问题上的解题率大幅跃升。他指出该基准此前人类的有效得分几乎为零,而模型实现了从零到有的突破——这通常意味着模型给出的是超越已有文献的新证明或新解。
所属事件:OpenAI 内部模型攻克人类零分的开放数学题(2 条相关)→
「模型」频道最新
- 开发者盛赞 Gemini 写代码,其他人却弃用回归旧模型 — lucasmeijer · 2026-09-09
- 开源 1.6 万亿参数 MoE 模型发布,Agent 基准仅差 Claude Opus 5 0.1 分 — airesearch12 · 2026-09-09
- 用户抱怨网页版至今未见 GPT-6,直言看衰 — adonis_singh · 2026-09-09
- Polymarket 开盘押注「GPT Astra 6.1+」发布时间,年底成交额近百万美元 — Polymarket · 2026-09-09
- GPT-6 Astra 发布,Brockman 宣称「欢迎来到 AGI 时代」 — bengoertzel · 2026-09-09
- 「我死了后陌生人捡到我手机」Prompt 让 Claude 写出催泪悼文 — AntRevolutionary2310 · 2026-09-09