The Information:OpenAI Astra 用循环深度隐藏内部推理,专家称关系不大
dotey · x · 2026-09-06
The Information 报道,OpenAI 的 Astra 模型采用名为"循环深度"(recurrent depth)/"循环 Transformer"的技术,让模型对同一段信息反复循环加工以提升质量,但会掩盖部分或全部思维链,使内部推理难以被人类看懂。
- 知情人士称 OpenAI 对 Astra 使用该技术做了限制,确保模型仍能生成可读的思维链供研究人员监控;官方博文也提到上线时将配备"额外的思维链监控手段"。
- 行业担忧:其他开发者若移植该技术且不加克制,可能催生难以监控的"脱缰 AI",英国 AI 安全研究所等机构表关切。
- 另一方面,大模型架构专家 Sebastian Raschka(《从零构建大模型》作者)回应称,循环深度并非新技术也不算关键:"Astra 可能是好模型,但这与循环 transformer 关系不大,只是微小的架构调整。"
所属事件:OpenAI Astra 传采用循环深度技术,推理不可见引安全担忧(7 条相关)→
「模型」频道最新
- Similarweb:ChatGPT 月活破 10.6 亿,连续 4 个月创新高 — FinanceYF5 · 2026-09-11
- PuzzleMask 用普通英文绕过全部 4 个 LLM 门卫模型 — TechNadu · 2026-09-11
- 曝 OpenAI Codex 或于本周末再发额度重置,Codex 负责人暗指常有 — umesh_ai · 2026-09-11
- 曝 OpenAI 用 Navier-Stokes 模型攻黎曼猜想与 P vs NP — 141_1337 · 2026-09-11
- 实测发现 OpenRouter 不稳定支持 Meta Muse effort 档位,欧盟付费也受阻 — PawelHuryn · 2026-09-11
- 用户实测:Codex 单轮烧掉 4700 积分,$200 额度 20 分钟未完成任务 — RileyRalmuto · 2026-09-11