Parakhin评GPT-5.6数学能力:优于Fable但不及5.2 Pro
MParakhin · x · 2026-07-20
微软 CEO Mikhail Parakhin 回应了开发者关于模型数学能力的反馈,表示 GPT-5.6 在数学研究方面的表现确实明显优于 Fable(尤其是 Pro 版本),但整体上仍未达到曾经的 GPT-5.2 Pro 水平。他推测 GPT-5.2 Pro 之所以推理能力惊人,是因为其拥有极高的推理预算,并且可能采用了大数值的 best-of-n 采样策略。
所属事件:GPT-5.6连破历史数学难题,证明能力大幅提升(10 条相关)→
「模型」频道最新
- Kimi K3 软件任务峰值 89.4%,Fable 5 稳定性略高 — FinanceYF5 · 2026-07-21
- Kimi K3 只在 Go 领先,Fable 5 包揽其余四种语言 — FinanceYF5 · 2026-07-21
- Kimi K3 pass@4 达到 89.4%,超过 GPT-5.6 Sol — FinanceYF5 · 2026-07-21
- Kimi K3 与 Fable 5 的差距已不像过去那样明显 — FinanceYF5 · 2026-07-21
- 一条转发称 Claude 现在能在几分钟内做完整 App — hey_abusiddik · 2026-07-21
- Qwen3.8 Max Preview 被吐槽思考长达 10 到 30 分钟 — vista8 · 2026-07-21