从 9.9>9.11 翻车到挑战最难数学题,两年 AI 反差
Yuchenj_UW · x · 2026-10-07
作者感慨两年间的反差:2024 年大家还在嘲笑 GPT-4o 连「9.9 是否大于 9.11」都答错,如今感觉最难的数学问题都将被 AI 解决,感叹时代变化之快。
「模型」频道最新
- HuatuoGPT-3 仅 27B 在 HealthBench 达 70.1,超越 GPT-6 Astra — CUHKSZ · 2026-10-07
- 开发者抱怨长任务夜间撞用量上限,auto reload 未生效 — willdepue · 2026-10-07
- Gary Marcus 回应质疑:前沿 LLM 能否裸解开放数学难题? — GaryMarcus · 2026-10-07
- OpenAI 宣称解决 372 个未解难题,平均每题仅耗约 3 小时 — i_dg23 · 2026-10-07
- 实测:OpenAI Decisions API 比 Jev 贵 2 倍、效果差 5-10% — xeophon · 2026-10-07
- Cagliostro V3.5 135M 登顶 Open SLM 榜,智能指数 27.49 超 SmolLM2 — Megneous · 2026-10-07