UK AISI Evaluation Finds GPT-6 Astra Solves 30-Minute Human Tasks Without CoT
英国 AI 安全研究所(UK AISI)发布对 OpenAI 新模型 GPT-6 Astra 的独立评估,核心结论是:该模型无需思维链(CoT),在单次前向传播中即可完成人类需约 30 分钟的困难任务,且推理风格更加压缩、外部可读性下降。这一结果被多位发帖者转述,引发 AI 安全社区对模型推理过程外显程度降低的担忧。
已确认
- 无 CoT 数学时距(time horizon):Astra 达 30.9 分钟,而 GPT-5.6 Sol 仅 3.6 分钟,@haider1 计算约为其 10 倍(@teortaxesTex 转述中称约 8 倍,帖间略有出入)。
- Astra 能在单次前向传播中解出远难于以往模型的数学题,被视为相对前代的显著能力跃升。
- 评估指出 Astra 以比 GPT 5.6 Sol 和 GPT 5.5 更「压缩」的风格进行推理;其原始推理过程总体仍可被理解,但含义不明短语的出现频率有所增加。
尚未确认
- 帖子间对「前代的 8 倍还是 10 倍」表述不一,具体倍数以 AISI 原始报告为准。
为什么重要
- 无 CoT 即完成长时距任务,意味着模型的内部推理更少外显,监控与对齐研究所依赖的推理可读性收窄,这正是安全研究者担忧的焦点(@RyanGreenblatt 转述中明确提及此点)。
- 推理压缩化趋势若持续,可能系统性削弱基于推理过程外显的安全评估方法的有效性。
2026-09-04 ~ 2026-09-04 · 5 related posts
Primary sources
- UK AISI eval: GPT-6 Astra hits 30.9-min no-CoT math time horizon, 8x GPT 5.6 Sol — teortaxesTex · 2026-09-04
- [source] UK AISI Tests: Astra Hits 30.9-min No-CoT Math Horizon, 10x GPT-5.6 Sol — haider1 · 2026-09-04
- UK AISI assessment: Astra reasons in a more compressed style than GPT 5.6 Sol — maksym_andr · 2026-09-04
- Astra can do 30-minute human tasks without chain-of-thought, shrinking monitoring surface — RyanGreenblatt · 2026-09-04
1 near-duplicate retellings: maksym_andr