GPT-6 Astra 疑可无显式推理解竞赛数学,CoT 监控遭削弱

GaryMarcus · x · 2026-09-04

Robert Wiblin 与 Gary Marcus 转发对 OpenAI 安全策略的强烈批评:OpenAI 似乎为了保持竞争力而放弃了目前唯一真正有效的安全保证手段——思维链(CoT)监控,被称「彻底灾难性」。

核心信息来自引用的 Ryan Greenblatt 帖:

若后续模型代际都出现类似跳变,CoT 监控这一安全手段的有效性将持续下降。

所属事件:GPT-6 Astra 更对齐却更难监控引安全界警觉(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →