OpenAI 被曝采用循环深度架构,思维链或不可监控
据 The Information 等多方报道,OpenAI 正在其 Astra 项目中使用一种名为「循环深度」(recurrent depth)或「循环 Transformer」的新推理架构,相关技术还被指涉及「neuralece/neuralese」方向的突破。多位转发者(@sjgadler、@stephpalazzolo)转述称,这一方法允许模型通过多次处理同一段文本来改进答案,带来性能提升和成本降低,但当模型规模扩大时,其内部「思考」过程不会以外显思维链形式展示。
已确认
- 多篇报道(m1、m4、m5)一致指出 OpenAI 及其他公司在使用循环 Transformer 类架构,且该架构会隐藏模型推理过程
- 英国 AI 安全研究所已在 5 月报告中指出,这类技术可能会「严重削弱当前的监控方法」(m6)
- 该技术在提升模型性能、降低成本方面有明确收益(m1、m3)
尚未确认
- OpenAI 内部对安全性与可解释性的具体态度、以及实际部署范围,帖中仅有「内外部担忧」的说法,未见官方回应
- m4 提到的「neuralese」技术突破细节,仅有 The Information 一方说法
为什么重要
- 监控模型思维链被视为目前 AI 安全领域一个「脆弱的安全机会」(m3),多位顶尖 AI 研究员担忧该架构会破坏这一机制,使模型行为更难监控和解释
- 性能与成本的收益,与安全可解释性的损失之间形成权衡,可能影响整个行业后续对推理架构与对齐工作的取舍(m1、m3、m6)
2026-09-02 ~ 2026-09-02 · 6 条相关
一手来源
- OpenAI 推出新推理法“循环深度”,或致模型思考过程不透明 — steph_palazzolo ·
- 曝 OpenAI 突破 Astra 架构,或致链式思考不可监控 — sjgadler ·
- OpenAI 新推理技术遭英国安全研究所警告 — pstAsiatech ·
- 【源头】OpenAI 新推理技术遭英国安全研究所警告 — pstAsiatech · 2026-09-02
- 【源头】OpenAI 推出新推理法“循环深度”,或致模型思考过程不透明 — steph_palazzolo · 2026-09-02
- OpenAI 被曝秘密使用循环 Transformer,规模扩大后隐藏思考过程 — steph_palazzolo · 2026-09-02
- 【源头】曝 OpenAI 突破 Astra 架构,或致链式思考不可监控 — sjgadler · 2026-09-02
- OpenAI 新架构隐藏思维链,引发安全担忧 — sjgadler · 2026-09-02
- 报告称 OpenAI 采用隐藏思维链的新架构 — sjgadler · 2026-09-02