ConjectureBench发布,前沿AI模型已破解数十年数学难题

Bespoke Labs最新推出了ConjectureBench基准测试,其中包含1.5万个开放数学问题,旨在评估和提升AI智能体在数学领域的探索能力。测试表明,前沿AI模型在解决长期悬而未决的数学难题上展现出惊人潜力,例如已有用户借助Claude 3.5成功推翻了困扰数学界80年的雅可比猜想,标志着AI正成为攻克百年数学难题的重要工具。

2026-08-01 ~ 2026-08-01 · 2 条相关