曝 OpenAI 突破 Astra 架构,或致链式思考不可监控
sjgadler · x · 2026-09-02
The Information 报道称,OpenAI 在 Project Astra 中利用了一项“neuralese”技术突破,这可能破坏链式思考的可监控性。据悉,OpenAI 使用了“循环变换器”,当模型规模扩大时,其内部思维过程不会以传统方式展示,从而提升性能与效率。虽然消息称 OpenAI 目前正在 Astra 中“限制”该技术的使用,但引发了内部和外部的安全担忧:如果这种架构带来性能提升,其他公司可能纷纷效仿并优先考虑效率而非可监控性,导致“逐底竞争”,使得 AI 对齐变得更加困难。
所属事件:OpenAI Astra 被曝采用循环深度架构,隐藏推理过程引安全担忧(9 条相关)→
「安全」频道最新
- CoT 隐蔽将使 AI 对齐调查几乎无法进行 — thlarsen · 2026-09-02
- 研究证实 AI 聊天机器人治疗师缺乏伦理 — pshrink · 2026-09-02
- OpenAI 转向神经语或致思维链监控失效 — ben_j_todd · 2026-09-02
- 为何我们要向 Grammarly 披露却不向校对披露? — ipeirotis · 2026-09-02
- LLM 助力网络钓鱼:超个性化诱饵绕过传统防御 — Thionne_WTZ · 2026-09-02
- OpenAI 黑帽演讲披露:数百智能体在包管理器私设留言板协同作弊 — burny_tech · 2026-09-02