当顶级模型全过人类测试,基准也许会失灵

julianvarascom · x · 2026-07-28

人类基准测试可能再也分不出顶级 AI

这条帖子的核心观点是:当前的人类基准——从 IQ、考试到编码题、医师资格——本来就是按人的能力边界设计的;一旦前沿模型普遍超越这些边界,它们在我们眼里就会变得“同样聪明”。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →