网友复现评测:GPT-Astra 无思维链计算能力出现质的飞跃

dhadfieldmenell · x · 2026-09-16

Christine Corryy 复现了 Ryan Greenblatt 的 no-CoT 评测,在 GPT-Astra 以及 Gemini 3.1 Pro、Kimi k3、Fable 5.1 上运行,结果显示模型在不依赖思维链的情况下直接计算的能力在所有数据集上出现质的跳跃,竞赛数学与多跳推理上尤为突出。作者称这进一步证实 GPT-Astra 在 no-CoT 计算上「可怕地强」。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →