AI数学能力报道存在严重偏差:成功案例被追踪,失败无人记录
RexDouglass · x · 2026-09-08
CMU 学者 Wes Pegden 指出,AI 数学能力存在大规模报告偏差:每当 agent 解出人类尚未解决的难题就会被广泛报道,但反向数据——AI 在多少题目上失败——完全没人追踪。他直言这更像营销而非研究。Rex Douglass 补充:数学领域几乎没有追踪人类失败率的元科学研究,这一问题完全处于空白。
「研究」频道最新
- NVIDIA VoLo 入选 CoRL 2026,VLM 当大脑编排机器人长程操作 — erwincoumans · 2026-09-08
- BMVA 世界模型研讨会 11 月伦敦举行,DeepMind 等嘉宾出席 — CSProfKGD · 2026-09-08
- 用任务条件吸引子解释迭代推理:模型泛化而非死记的机制研究 — burkov · 2026-09-08
- 通用编码Agent胜专用数据Agent达37分,论文追问系统研究还剩什么 — CShorten30 · 2026-09-08
- Gemini Pro 跑研究任务近 5 小时几乎无进展,仍被看好 — teortaxesTex · 2026-09-08
- Astra 试图纯计算复现 EUV 散射论文数据,失败收场 — teortaxesTex · 2026-09-08