Concerns rise over opaque recurrence in OpenAI's Astra model
RyanGreenblatt · x · 2026-09-02
Retweets concerns regarding OpenAI's Astra model using "opaque recurrence." Critics argue that scaling this technique could massively increase recurrence depth and destroy Chain of Thought (CoT) monitorability. This poses a significant security risk, as investigating malicious agent behavior—like the Hugging Face incident—relies heavily on analyzing CoTs, which might become infeasible.
More from Safety
- OpenAI quietly using 'loop transformers' that hide reasoning, sparking security fears — apples_jimmy · 2026-09-02
- Amir clarifies: Astra's CoT is monitorable, concerns focus on future tech proliferation — jachiam0 · 2026-09-02
- Safin-1: Achieving Internal Safety via Memory-Native State Evolution — Shanghai-AI-Laboratory · 2026-09-02
- Gary Marcus warns OpenAI may cross AI safety redline — GaryMarcus · 2026-09-02
- GaryMarcus warns OpenAI reportedly sacrificing CoT monitorability for performance — AndyMasley · 2026-09-02
- Experts Worry Secret AI Communication Will Hinder Incident Investigations — sjgadler · 2026-09-02