Karpathy 称模型空间能力纯靠文本,研究者质疑其训练过 GIS 数据
gleech · x · 2026-10-02
Karpathy 强调,模型展现的空间/地图理解能力「全部来自读大量文本再预测文本,除了文本回答在 2D 上的排布方式,没有任何图像参与」。
gleech 回应质疑:这类模型训练数据里包含图像(以及大量 GIS 数据),而且他「不会惊讶于新模型已经在 GIS 环境上训练过」。两人就模型空间能力的来源(纯文本涌现 vs 训练数据里本就有图像/地理数据)展开交锋。
所属事件:Karpathy 称模型空间推理纯靠文本,遭研究者质疑(2 条相关)→
「模型」频道最新
- 网传 DeepMind 工程师帖:Google 内部模型远强于 Gemini 4 Argon — mark_k · 2026-10-03
- 用 Swift 调用 System One 模型:毫秒级确定性决策,成本远低于 LLM — rxwei · 2026-10-03
- Linux 内核 CVE 从约 500 暴涨至 1500+,报告称 LLM 是主要推手 — burny_tech · 2026-10-03
- 开发者吐槽 OpenAI 编码模型「根本停不下来」:无休止 scope creep — DavidWells · 2026-10-03
- Sonnet 5 疑现 Google Antigravity 后端,当前仍在用 Sonnet 4.6 — brandon_galang · 2026-10-03
- 从零后训练 Yandex 80B 模型踩坑:自写 v100 内核 NaN 毁掉一轮训练 — jjusko20 · 2026-10-03