OpenAI Astra 隐式思维链引安全担忧
burny_tech · x · 2026-09-02
OpenAI 的新模型 Astra 采用了一种名为“recurrent depth”的推理方法。虽然该方法有助于优化成本和性能,但研究人员表示担忧,因为它在 token 之间进行静默思考,使得模型思维过程变得不透明,增加了监测和干预的难度。
所属事件:OpenAI Astra 被曝循环深度潜空间推理,安全圈忧 CoT 监控失效(96 条相关)→
「模型」频道最新
- GPT-Live-1 可同时听说、GPT-image-2.5 跨轮修图,交互转向实时协作 — WirelessLife · 2026-09-12
- 只看 pass/fail 分数已无法解读评测:隐藏测试过严致大量误判 — trq212 · 2026-09-12
- LightSpeed 播客:GPT-6 Astra 推理链可绕过部分监控,审计力成新卖点 — buckymoore · 2026-09-12
- OpenAI 图像生成输出格式不可控,预览图常比成图更好 — No_Body_4834 · 2026-09-12
- 用户报告 Gemini Pro 3.1 突然拒绝回答简单请求 — kostaslamprou · 2026-09-12
- 初创公司用 GPT-6 Astra 打造无人机,一张照片即可锁定追踪特定人 — Polymarket · 2026-09-12