Claude Opus 5 据报在 2026 IMO 拿下 42/42 满分
exordin26 · reddit · 2026-07-25
- 配图是一份评测/报告截图,声称 Claude Opus 5 在 2026 IMO 上拿到了 42/42 满分。
- 报告里写到,模型把六道题都做出来了,并且每道题生成了四份独立解答。
- 评估方式也很特殊:由三位前沿模型评审,只有三者一致认为正确才算通过。
- 报告称这个成绩对应 金牌水平,明显高于 2026 年 IMO 的金牌线 29/42。
- 截图还说明这次测试没有使用 agent 工具链,输出上限为 256,000 tokens,并启用了 adaptive thinking at max effort;其中一道题因为撞到输出上限而重新采样。
所属事件:网传 Claude Opus 5 无工具拿下 2026 IMO 满分(5 条相关)→
「模型」频道最新
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11