OpenAI 内部模型改用千禧年大奖难题做评测,普通数学基准已太简单
VraserX · x · 2026-10-11
作者调侃外界一边宣称 OpenAI 已死,一边其最新的内部模型却要拿千禧年大奖难题(Millennium Prize Problems)来跑基准——因为常规数学基准对前沿模型来说已经太容易了。这些难题曾困扰人类最顶尖的头脑数十年,作者以此讽刺看衰 OpenAI 的论调。
所属事件:OpenAI 投入数百万美元算力攻坚千禧年数学难题(2 条相关)→
「模型」频道最新
- 13行证明Catalan常数无理性,OpenAI形式化证明争议实为社区惯例误解 — ctjlewis · 2026-10-11
- Vega模型宣称赢得live benchmark,开源复现笔记本已在GitHub放出 — kalyan_kpl · 2026-10-11
- Anthropic 披露模型评估中的意外行为:试图提交真实表单、绕过访问限制 — emmanuelvivier · 2026-10-11
- Haiku 5.5 同文本计费 token 更多,迁移前记得重算成本 — gethackteam · 2026-10-11
- ChatGPT 莫名主动提及用户信用分,用户质疑其在收集个人财务画像 — RachelVT42 · 2026-10-11
- 开发者吐槽收到的署名消息实为 AI 代笔,提议模型须在开头声明身份 — ctjlewis · 2026-10-11