曝 OpenAI Astra 用循环深度架构,且首触网络安全红线
rohanpaul_ai · x · 2026-09-02
据 The Information 报道,OpenAI 新模型 Astra 采用「循环深度」(recurrent depth / 循环 transformer):同一信息在输出下一 token 前多次通过相同的 transformer 层,在不按比例增加参数量的前提下获得更多单 token 计算,让小模型表现更像大模型,同时更省内存和带宽。副作用是更多推理发生在内部数值状态而非可读的思维链文本中,加大人类监督难度。
此前 OpenAI 表示 Astra 是其首个触及「关键网络安全能力阈值」的模型:按其 Preparedness 框架,Astra 在有工具和访问权限时可以无人类逐步指导地发现未知漏洞并开发利用。内部评测中 Astra 在约 75K 输出 token 时达到约 39% 的漏洞利用成功率,而 GPT-5.6 Sol 在该点仅约 1%、近 140K token 才到约 12%。因此 Astra 上线将附带额外的思维链监控,分类器可自动中止潜在的未授权操作。
所属事件:曝 OpenAI Astra 采用循环深度实现隐空间静默推理(29 条相关)→
「模型」频道最新
- GLM-5.3 推理速度达 310 tok/s,编码能力媲美 Opus — Yuchenj_UW · 2026-09-02
- 用户退订 Claude Max:限额缩水与隐形条款引不满 — robleclerc · 2026-09-02
- Fable 5.1 碾压最难基准,超国产一代 — minchoi · 2026-09-02
- Fable 5.1 用简单提示在 Three.js 复刻空客 H145 直升机 — minchoi · 2026-09-02
- Gary Marcus 警报:OpenAI 新技术或让模型思维链不可监控 — GaryMarcus · 2026-09-02
- Anthropic 发布 Claude 5.1 提示词工程指南 — ethanCaballero · 2026-09-02