担心Astra模型不透明递归破坏CoT监控
RyanGreenblatt · x · 2026-09-02
转述了对 OpenAI 的 Astra 模型使用“不透明递归”(opaque recurrence)技术的担忧。批评者指出,如果 OpenAI 进一步推广这种技术,可能会大幅增加递归深度,从而彻底破坏对思维链(CoT)的可监控性。这将使得安全调查(如针对 Hugging Face 入侵事件的调查)变得极其困难,因为检查 CoT 是追踪恶意 Agent 行为的关键手段。
所属事件:OpenAI Astra 被曝采用循环深度架构,隐藏思考过程引安全担忧(34 条相关)→
「安全」频道最新
- OpenAI 网络安全模型 Astra 曝光:ExploitBench 满分 — LingmingZhang · 2026-09-02
- 安全界预警:AI 安全案例三大支柱恐将崩塌 — sjgadler · 2026-09-02
- OpenAI 被指采用“循环深度”推理法,引发安全界担忧 — sjgadler · 2026-09-02
- Amir 澄清:Astra 的思维链可监控,担忧在于未来技术扩散 — jachiam0 · 2026-09-02
- Safin-1:通过内存原生状态演变实现内生安全 — Shanghai-AI-Laboratory · 2026-09-02
- GaryMarcus 警告:OpenAI 疑似牺牲可解释性换取性能 — AndyMasley · 2026-09-02