Redwood 研究员批 OpenAI 禁用 reasoning 反而损害可监控性研究
RyanGreenblatt · x · 2026-09-06
Redwood Research 的 Ryan Greenblatt 发长文批评 OpenAI 关闭公开 API 的 reasoning=None 选项。OpenAI 暗示这是出于安全/监控考虑——Astra 有更强的潜藏推理能力、更不依赖 CoT——但 Greenblatt 认为这恰恰说明研究无 CoT 能力更重要:
- 禁止公众关闭推理并不能消除可监控性问题:开启推理时模型仍可能在内部潜藏推理而不外显,而这才是能力更强、更值得担心的情形
- 他推测 OpenAI 真实动机更可能是防越狱或防蒸馏
- 关闭推理选项历来是测试模型隐蔽越轨(subversion)能力的重要手段;Anthropic 对 Fable 也同样不允许关闭 CoT,这不是一家的问题
- 他建议厂商推出低门槛的研究者访问计划,开放包括禁用推理在内的更多 API 能力
结论:厂商应明确承认「不允许关闭推理」对可监控性科学是实质性伤害。
「模型」频道最新
- 程序员戏称 Codex 里的 GPT-10 Astra 为 Astral Codex Ten — jam3scampbell · 2026-09-06
- 开发者实测 GPT-6 Astra 一天:重构代码更聪明,编码几乎无需换模型 — ivan_bezdomny · 2026-09-06
- Armin Ronacher:多数模型的推理档位写在系统提示里,切换即废 KV 缓存 — mitsuhiko · 2026-09-06
- GPT-6 Astra 攻克 LaTeX 图表难关,6 个月才刷满该基准 — FateOfMuffins · 2026-09-06
- GPT-6 Astra 发布:Epoch 指数 169 破纪录,但推理过程更难被监督 — ivan_bezdomny · 2026-09-06
- OpenAI 修复 Codex 无限用量漏洞,用户 8 小时烧掉 30-40 倍额度 — returnity · 2026-09-06