Gary Marcus吐槽:商业LLM连井字棋都玩不明白
GaryMarcus · x · 2026-08-04
Gary Marcus 转发了一篇三年前的旧帖,指出当前的商业大语言模型(LLM)在棋类游戏中的表现依然十分糟糕,甚至无法击败认真的玩家(除非调用外部工具)。
他引用的互动记录显示,即使要求 GPT-4-Turbo 采用最优策略下井字棋,它依然会犯下极其低级的错误并输掉比赛。这再次引发了关于 LLM 是否真正具备逻辑推理能力,还是仅仅在模仿文本模式的讨论。
「Fun」频道最新
- 实测四大模型对“上帝存在吗”的回答:差异巨大 — Ibz04 · 2026-08-05
- AI 视频实测:第一人称夜跑森林竟穿帮进入室内 — fofrAI · 2026-08-05
- AI公司违规排行榜:OpenAI与Anthropic安全事件积分 — felpix_ · 2026-08-04
- XBOW发起AI安全挑战:邀请全网向其系统投递漏洞 — moyix · 2026-08-04
- 实测曝光:API 聚合器 GlobalGPT 挂羊头卖狗肉,用免费模型冒充 Claude — blade944 · 2026-08-04
- 机器人专家:轮式底盘是防机器人造反的安全功能 — chris_j_paxton · 2026-08-04