LLM 已能做前沿数学反证
ctjlewis · x · 2026-07-20
LLM 似乎已经能做一些前沿数学里的反证任务。 帖子进一步追问:从“证明不成立”到真正的证明,再到构造性证明,模型还要跨过多大的能力台阶。
「模型」频道最新
- Epoch AI直播测试GPT-5.6玩《杀戮尖塔》 — dr_cintas · 2026-07-21
- 同题对测两款模型都一次过,讨论转向 Loop Engineering — glenbeer · 2026-07-21
- Emad Mostaque 认为 Kimi K3 推理成本未来数月可降 10 到 50 倍 — rohanpaul_ai · 2026-07-21
- 用户晒出 GPT-5.6 具身化写作样本,效果出人意料 — Comfortable_Ebb5519 · 2026-07-21
- Reddit 追问 Kimi K3 是否已够生产级 Agent 使用 — CommercialClient2408 · 2026-07-21
- 韩国初创模型在 AAII 得 44 分,接近 DeepSeek V4 Pro — JungWooHa2 · 2026-07-21