NeurIPS 论文:LLM 被明令禁止思考时仍停不下来
james_y_zou · x · 2026-10-09
一篇 NeurIPS 2026 论文《LLMs Keep Thinking When Told Not To》发现了「思考惯性」(Thinking Inertia)现象:即使明确指示 LLM 不要思考,模型仍会继续推理——有时答案是对的,但未能遵守「禁止思考」的指令。
要点:
- LLM 习惯于「更长时间思考」,但缺乏「何时停止思考」的控制能力
- 指令遵循失败发生在元认知层面:模型知道答案却无法抑制默认行为
- 作者观点:知道何时不该思考,与知道如何思考同样重要
这一现象对推理成本控制和指令遵循评测都有实际意义。
「模型」频道最新
- ARC-AGI-3 榜首易主:Yi-Chia Chen 以 59.17% 反超 tufalabs — fchollet · 2026-10-09
- ARC-AGI-2 榜首突破 88%,tufa labs 拿下 2026 高分纪录 — fchollet · 2026-10-09
- Yacine 转述:OpenAI 数学突破靠 Lean RL 环境,后训练是富人的推理 — yacineMTB · 2026-10-09
- Kalshi 与 Polymarket 押注 Claude 与 Gemini 年底并列最佳模型,因 Argon 4 发布 — matt_slotnick · 2026-10-09
- Codex /fast 模式实测仅 16-44 token/s,被吐槽「不如改名 /wait」 — lxfater · 2026-10-09
- 有人每周烧掉五个 20x 套餐额度,重度 Claude 用户用量引惊叹 — ChanceKelch · 2026-10-09