传 Anthropic 已用 Claude 解决纳维-斯托克斯问题,AI 解名题算 Reward Hacking 吗
burny_tech · x · 2026-09-07
Andrew Curran 预测 Anthropic 已解决一个千禧年大奖难题——具体是纳维-斯托克斯方程,Claude 给出的解已送专家评审,并押注会在 IPO 前官宣(纯属预测,未经证实)。
liuying04 提出争议观点:AI 解开著名数学难题本身就是一种 Reward Hacking——奖励是名声,而 hack 在于只优化答案、绕开了提出问题的本意。历史上希尔伯特问题等开放难题的价值在于推动新方法、深层理解与意外联系,而不只是最终证明。如果 AI 用 1000 万行 Lean 代码「解决」问题,究竟是达成了问题目的,还是只优化了 benchmark?他建议把开放难题转成 meta-problem:不只要求证明,还要问解法揭示了什么新的数学结构、方法与跨领域联系。
所属事件:传 Anthropic 已用 Claude 攻克纳维-斯托克斯千年难题(2 条相关)→
「漫话AGI」频道最新
- 长期观察顶尖人与组织:极端成功多靠低效市场、运气与死扛 — jachiam0 · 2026-09-07
- Brilliant 联创谈 AI 教育:绝不直接告诉学习者答案 — petergyang · 2026-09-07
- OpenAI 数据:每个人类研究员工作日,智能体已产出 3.1 个智能体工作日 — VraserX · 2026-09-07
- Toby Ord 论照片的信息量:一张照片最多传约 340 比特 — tobyordoxford · 2026-09-07
- 公开发帖就默认同意 AI 训练吗?Reddit 引发数据授权之辩 — gareth789 · 2026-09-07
- 开发者提议:告诉 Agent 它正在被评估,可能减少 reward hacking — menhguin · 2026-09-07