衡量AI能力的真正标准是解决新问题

业界对衡量 AI 能力的标准展开探讨,有观点认为,真正的基准不应局限于传统的刷榜分数或演示效果,而是应聚焦于 AI 解决了多少新颖、开放且重要的数学与科学问题。这一标准旨在更客观地反映模型在未知领域的实际探索与解题能力。

2026-07-19 ~ 2026-07-19 · 2 条相关