AI 仍过不了这些智力测验:空间旋转与视觉推理是明显短板

MIT Tech Review AI · rss · 2026-08-26

MIT Technology Review 整理了一组曾让 AI 模型翻车的智力题,让读者亲自挑战,同时借此梳理当前大模型与人类认知的差异。

主要发现:

从 2024 年底 Columbia 团队测得最好的模型只能解 18% 的 NYT Connections 谜题,到 2025 年初部分模型近乎完美,AI 解谜能力进步飞快——但人类仍各有胜场。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →