实测前沿AI数学能力:找反例惊艳,写长证明遇阻

在测试前沿AI模型的数学研究能力时,开发者发现AI在寻找反例方面表现出色且令人印象深刻,但在构建严谨的长篇证明以将猜想转化为定理时却显得极为困难。测试者感叹,相较于找反例,给出长证明不仅难度更大,也更具实用价值,并自嘲可能选了一个过于硬核的问题来考验模型。

2026-08-01 ~ 2026-08-01 · 2 条相关