为什么模型数不对 strawberry:r 需逐个枚举而非目测
ctjlewis · x · 2026-09-10
作者解释 LLM 在「数 strawberry 里有几个 r」上翻车的根本原因:计数看似简单,实则必须逐步进行——唯一的办法是一个一个数,这正像猜罐子里糖豆数一样不平凡。
- 模型在回答「这个单词有几个字母」时,很少见过训练文本里有人真的逐个枚举,于是倾向于「目测」整体,从而出错。
- 如果模型被引导按 1. s、2. t、3. r……逐个列出再计数,就能正确数出 r 的数量。
- 这是「需要中间步骤的最简单推理问题」的典型例子,也是 reasoning 模型价值的一个直观注脚。
所属事件:大模型数不对 strawberry 的 r:计数需逐步枚举(2 条相关)→
「模型」频道最新
- GPT-6 Astra 无思维链完成 34 步心算,达 Sol 的 4 倍 — MaartenBaert · 2026-09-10
- NVIDIA 深度解析 Alpamayo 2 Super:面向 Robotaxi 的 L4 自驾模型 — drmapavone · 2026-09-10
- OpenAI 用户额度无故清零,每周重置日还悄悄推迟了两天 — ___Patrice___ · 2026-09-10
- 网友预测 Qwen V4.1-Flash 新基准将得 36-38 分 — teortaxesTex · 2026-09-10
- Perplexity 评测 13 款检索模型,pplx-embed-v1-4b 两项领跑 — perplexity_ai · 2026-09-10
- 网友算 Astra 用量账:GPT-8 蜂群吃掉 1.8 亿 GPU,Pro 订阅或暂停 — burny_tech · 2026-09-10