Redwood 实测:Astra 借 filler token 无人化推理,CoT 监测或失效

scaling01 · x · 2026-09-26

Redwood Research 发布评测,研究 GPT-6-Astra 在提示词被填充大量无意义「filler token」(如省略号)且被要求直接作答时的表现。

核心发现:

安全含义:这说明 Astra 能在思维链(CoT)之外执行大量未言明的认知过程,意味着基于 CoT 的模型行为监测(monitorability)可能失效,是一个值得警惕的能力信号。

所属事件:Redwood 报告:填充无意义 token 大幅提升 GPT-6 推理(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →