GPT-5.6 数学表现引发讨论
airkatakana · x · 2026-07-19
作者观察到 **gpt-5.6** 在一些开放数学问题上表现很强,甚至“拿下了很多题”,但 **fable** 没有出现类似结果。 他在质疑这究竟是因为 OpenAI 给了更多 token,还是模型本身的数学能力更强,并把问题指向了推理预算与模型能力的区分。
所属事件:GPT-5.6连破历史数学难题,证明能力大幅提升(10 条相关)→
「模型」频道最新
- 研究者争论 GPT-OSS 是否真的存在明确危害 — aiamblichus · 2026-07-21
- Kimi K3 软件任务峰值 89.4%,Fable 5 稳定性略高 — FinanceYF5 · 2026-07-21
- Kimi K3 只在 Go 领先,Fable 5 包揽其余四种语言 — FinanceYF5 · 2026-07-21
- Kimi K3 pass@4 达到 89.4%,超过 GPT-5.6 Sol — FinanceYF5 · 2026-07-21
- Kimi K3 与 Fable 5 的差距已不像过去那样明显 — FinanceYF5 · 2026-07-21
- 一条转发称 Claude 现在能在几分钟内做完整 App — hey_abusiddik · 2026-07-21