回想 2023 年 GPT-4 连小学应用题都会做错
tszzl · x · 2026-10-07
tszzl 发推提醒大家:2023 年的 GPT-4 还会被小学水平的故事应用题搞糊涂。短短两年多,模型在数学推理上的进步幅度之大,值得新入圈的人对比感受一下当时的能力基线。
「模型」频道最新
- 斯坦福提出 Priced Guidance:量化 LLM 能否预测未发表研究 — stanfordnlp · 2026-10-07
- Bindu Reddy:西方开源模型落后中国 3-6 个月,GLM 5.5 即将发布 — bindureddy · 2026-10-07
- Mistral 新模型被指远逊中美顶尖,法国评论人痛批主权战略失败 — AymericRoucher · 2026-10-07
- 用户吐槽 Gemini 惯性撒谎:先道歉再承认瞎猜 — ChocoBabiChan · 2026-10-07
- OpenAI 模型证明 Bloch 猜想,数学家 littmath 指出论文引用了错误文献 — littmath · 2026-10-07
- OpenAI 数学模型在「All the Math We Can Think Of」基准仅得 9.3%,4000 题对 372 — basedjensen · 2026-10-07