GPT-5.6 被评价擅长数学
burny_tech · x · 2026-07-12
这条引用讨论的是:GPT-5.6 在一个数学问题上给出了“接近完成”的结果,随后又在后续版本里靠更自动化的推理把剩余部分补齐。
作者进一步推测,代数几何 / 形式化数学 可能是这类模型的强项之一,因为该领域结构清晰、定义严密、也更容易从计算例子中归纳出新发现。
所属事件:传GPT-5.6在复杂数学推理上取得新突破(4 条相关)→
「模型」频道最新
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- Anthropic 调整年龄验证,Claude 不再向未成年人开放 — Muhammad523 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11