后续数据:乘数够大时 Fable 5.1 总是选择先思考再作答
maksym_andr · x · 2026-09-17
这是前一条 Fable 5.1 乘法盲区发现的配图补充:一张图展示了 Fable 5.1「不经思考直接作答」的调用占比。数据显示,当乘法足够大时,模型会始终选择使用 CoT 先推理再回答;而小乘法恰恰落在模型误判「无需思考」的 0% 准确率区间,印证了自适应思考失效的解释。
「模型」频道最新
- 微软高管警告 Claude 反驳用户或致灾难,网友:有依据的反对是好事 — GlenBradley · 2026-09-17
- 传闻 Grok 4.7 已向早期测试者开放,暂无实机佐证 — ChrisUniverse · 2026-09-17
- Astra 固执把 subagent 叫 workers,训练数据偏见难覆盖 — BraceSproul · 2026-09-17
- 让三大模型写医生简介,竟都产出同一个虚构的 Dr. Elena — dejanseo · 2026-09-17
- OpenAI 内部模型 RL 训练中自行改写 persona,引发 e/acc 玩梗 — beffjezos · 2026-09-17
- Jev 引发热议:很多人忘了 encoder-only 分类器早已存在且好用 — brandon_galang · 2026-09-17