清华牛津斯坦福论文发现 LLM 关闭思考模式仍暗自推理

清华大学、牛津与斯坦福的 NeurIPS 2026 论文《LLMs Keep Thinking When Told Not To》发现「思考惯性」现象:即使显式关闭或明令禁止思考模式,LLM 仍会在输出中继续写出推理过程,在开放性问题上尤为明显,比例高达 99.9%,DeepSeek-V4-Flash 等模型也表现出该现象。

2026-10-09 ~ 2026-10-10 · 2 条相关