为何 2026 年还留非思考模式?CoT 监控与性能双双要推理

scaling01 · x · 2026-09-17

一位研究者在与 @maksymandr 的讨论中谈到:如今基础模型即便不推理也比 GPT-4/GPT-4.5 强得多,纯看延迟和研究价值仍有意义;但现在已经「有点蠢」的是完全不用推理——哪怕是低档推理也能大幅提升性能。对方补充了两个原因:OpenAI 与 Anthropic 都相当依赖 CoT 监控,模型至少需要输出一些思维链才能被监控;而且 2026 年还保留一个完全不思考、直接作答的模型本身就显得奇怪。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →