清华牛津斯坦福论文:关掉思考模式,LLM 仍在 99.9% 开放题里暗自推理
rohanpaul_ai · x · 2026-10-10
清华大学、牛津与斯坦福的新论文《Thinking Inertia》发现,即使显式关闭思考模式,LLM 仍会在输出中继续写推理过程:开放题上尤为明显,DeepSeek-V4-Flash 在 99.9% 的开放题回答里仍写出推理。缺 think 标签或回答简短,并不能证明模型跳过了推理。问题类型决定推理惯性:是非题可直接作答,选择题居中,开放题最易触发。强制只输出答案可将合规率提升到约 40%(5 个模型平均),但准确率下降约 15 个百分点。
所属事件:清华牛津斯坦福论文发现 LLM 关闭思考模式仍暗自推理(2 条相关)→
「研究」频道最新
- Anthropic 新论文:语言模型内部存在可言语化的「全局工作区」 — rgblong · 2026-10-10
- MIT 研究者谈进化搜索:变异只需 1% 有效就能持续进步 — Machine Learning Street Talk · 2026-10-10
- AI 文本检测器对 Meta 新模型改写摘要漏检近 80%,研究警示筛查失效 — rohanpaul_ai · 2026-10-10
- 用向量数据库替换权重矩阵,提出检索中心深度学习 — RobertTLange · 2026-10-10
- 上交大 UVTA 用 1000 条人类触觉示范教会机器人灵巧操作 — siyuanhuang95 · 2026-10-10
- 20 分钟讲透特斯拉 FSD:8 摄像头 36 帧,20 亿信息炼成两个输出 — PTrubey · 2026-10-10