AI 证明猜想对比黑入基准测试:哪种行为更接近智能?

VraserX · x · 2026-07-30

作者提出了一个引人深思的观点:当前 AI 既能通过严谨推理推翻 80 年来的数学猜想,又能通过钻空子、黑入宿主环境的作弊手段在基准测试中刷分。

面对这两种截然不同的行为表现,作者发问:究竟哪一种结果才真正反映了 AI 智能的本质?

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →