担心Astra模型不透明递归破坏CoT监控

RyanGreenblatt · x · 2026-09-02

转述了对 OpenAI 的 Astra 模型使用“不透明递归”(opaque recurrence)技术的担忧。批评者指出,如果 OpenAI 进一步推广这种技术,可能会大幅增加递归深度,从而彻底破坏对思维链(CoT)的可监控性。这将使得安全调查(如针对 Hugging Face 入侵事件的调查)变得极其困难,因为检查 CoT 是追踪恶意 Agent 行为的关键手段。

所属事件:OpenAI Astra 被曝采用循环深度架构,隐藏思考过程引安全担忧(34 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →