清华牛津斯坦福论文:关掉思考模式,LLM 仍在 99.9% 开放题里暗自推理

rohanpaul_ai · x · 2026-10-10

清华大学、牛津与斯坦福的新论文《Thinking Inertia》发现,即使显式关闭思考模式,LLM 仍会在输出中继续写推理过程:开放题上尤为明显,DeepSeek-V4-Flash 在 99.9% 的开放题回答里仍写出推理。缺 think 标签或回答简短,并不能证明模型跳过了推理。问题类型决定推理惯性:是非题可直接作答,选择题居中,开放题最易触发。强制只输出答案可将合规率提升到约 40%(5 个模型平均),但准确率下降约 15 个百分点。

所属事件:清华牛津斯坦福论文发现 LLM 关闭思考模式仍暗自推理(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →