Astra 系统卡复现:无思维链下推理步数达次优模型 1.75 倍

burny_tech · x · 2026-09-12

Neel Nanda 复现了 Astra 系统卡的说法:该系统能在不使用思维链(CoT)的情况下完成大量计算。复现结果显示 Astra 跳跃巨大,无 CoT 时完成的推理步数达到次优模型(Fable 5.1 / Gemini 3.8 Flash)的 1.75 倍;且无 CoT 能力的提升幅度远超有 CoT 的场景,他称这是一个令人担忧的趋势。

Ryan Greenblatt 补充判断:这些数字可能仍低估了无 CoT 推理的跳跃——一是 ECI 方法难以处理基准饱和下的大跳跃,二是 Neel 未使用 filler tokens,而 Astra 似乎从 filler tokens 中获益更多,他觉得有点诡异。

所属事件:Astra 无思维链推理暴涨,隐蔽计算引安全担忧(8 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →