模型能解 IMO 题,却造不出新的 IMO 题
pranjalssh · x · 2026-09-15
- 引用帖指出一个奇怪的反差:当前模型战术解题能力极强(可达 IMO 水准),但在原创想法生成(idea generation)上却非常差,且这种失衡在新版本发布后似乎毫无改善。
- 发帖人进一步追问:模型能解 IMO 题,但它能「出题」吗?——质疑模型缺少真正的创造性构思能力。
「模型」频道最新
- 仅15天:开源Qwen3.8在企业评测四个维度反超Claude Opus 5 — ryanshrout · 2026-09-16
- OpenAI 语音服务降价 60%,并推出 ChatGPT 礼品卡 — borowcy · 2026-09-16
- 长文详解:为什么本地跑推理模型是刚需,你需要无审查模型 — HankYeomans · 2026-09-15
- Meta 推出 Meta One 订阅服务,$2.99/月;Polymarket 仅给其2%胜率 — Polymarket · 2026-09-15
- KoboldCpp 发布 v1.121 版本 — Fcking_Chuck · 2026-09-15
- CritPt 基准纠错后 GPT-5.6 pass@4 冲至 94.4% — bookwormengr · 2026-09-15