AI 模型在智力测试中频频翻车,人类仍占上风

nordicinst · x · 2026-08-26

MIT Technology Review 报道,尽管 AI 在解决纽约时报连线谜题等任务上进步迅速,但在面对经典逻辑谜题和视觉谜题时仍容易失败。文章通过多个实例(如骑士与无赖谜题、ARC-AGI 基准测试)展示了模型与人类认知的差异,指出模型往往难以处理谜题中的细微变化,视觉推理仍是其弱项。这些测试揭示了 AI 当前能力的边界。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →