新论文:主流 LLM 能否像人类一样通过认知发展测试
GolinoHudson · x · 2026-09-17
Alexandros Demetriou 发布新论文,研究 ChatGPT、Gemini、Grok、DeepSeek 等主流 LLM 在认知发展测试上的表现:它们在哪些方面接近人类、哪些方面落后;它们如何看待笛卡尔的「我思故我在」是否适用于自己,以及是否认为自己拥有与人类相当的通用智能。
「模型」频道最新
- 1B 参数模型端侧跑《毁灭战士》,延迟仅 150ms — joemeno · 2026-09-17
- 奥特曼:超 Astra 的内部模型能解世界顶尖数学家解不开的题 — nikola_mr64990 · 2026-09-17
- OpenAI 攻克数学难题,25 位菲尔兹奖得主联名警告风险 — nordicinst · 2026-09-17
- OpenAI 披露 6 起「令人担忧」的 AI 行为事件并建报告框架 — pstAsiatech · 2026-09-17
- 用户实测称「没有护城河」:某模型整体体验已超过 Claude — deepakns · 2026-09-17
- Multiverse 发 438B 量子数据模型,被指 GLM 5.2 base 换皮 — burny_tech · 2026-09-17