Chollet:base 模型零流体智力,ARC 1 扩容 10 万倍仅到 10%
fchollet · x · 2026-10-02
François Chollet 提出区分 base LLM 与现代 LRM 的关键:不是符号工具使用,而是从「直推范式」(直接直觉出查询答案)转向「归纳范式」(直觉出能产生答案的程序/指令链)。
- LRM 被训练为在测试时做归纳,即对自然语言程序/推理链做测试时预测,这解锁了全新能力,尤其是流体智力。
- Base LLM 至今流体智力几乎为零;LRM 已具备可观的流体智力。
- 数据佐证:2019 年的 ARC 1 上,base LLM 至今仍只有约 10–15%,扩容约 10 万倍也只从 0% 到 10%;而同等甚至更小尺寸的 LRM 在 2025 年已将 ARC 1 打满。
「模型」频道最新
- Nat Eliason 疑测 @bot 已换用 4.7,称其本周明显变聪明 — nateliason · 2026-10-02
- 多名用户称被路由至 Fable 5.5,SVG 测试远超 5.1 版本 — kimmonismus · 2026-10-02
- 180B 模型塞进单台 DGX Spark:2.39-bit 量化仅损失 4.5% — TheZachMueller · 2026-10-02
- 网友拆解Claude云session计费:赠token只能云端烧 — stablequan · 2026-10-02
- 一句 please continue 烧光 5 小时额度:6.5 分钟用尽引质疑 — thawingfrog · 2026-10-02
- Grok 4.7 已悄然上线网页版 — rohanpaul_ai · 2026-10-02