网友复现评测:GPT-Astra 无思维链计算能力出现质的飞跃
dhadfieldmenell · x · 2026-09-16
Christine Corryy 复现了 Ryan Greenblatt 的 no-CoT 评测,在 GPT-Astra 以及 Gemini 3.1 Pro、Kimi k3、Fable 5.1 上运行,结果显示模型在不依赖思维链的情况下直接计算的能力在所有数据集上出现质的跳跃,竞赛数学与多跳推理上尤为突出。作者称这进一步证实 GPT-Astra 在 no-CoT 计算上「可怕地强」。
「模型」频道最新
- 中国开源模型占 OpenRouter 53% tokens?研究者称数据误导 — ohlennart · 2026-09-16
- 模型研发怪圈:小众场景终会被通用能力吞并 — samiramanabi · 2026-09-16
- 爆料称 Google 正打造数学特化版 DeepThink,原始思维链颇为有趣 — PMinervini · 2026-09-16
- 玩家称在《辐射3》中发现 OpenAI GPT-6 Astra 彩蛋 — imjustnewatai · 2026-09-16
- 观点:模型提速 5 倍无感,20-50 倍才会改变工作方式 — gabriel1 · 2026-09-16
- 博主预测重磅一周:Opus 5.2、Codex Bot 与降价版 Sol 将齐发 — daniel_mac8 · 2026-09-16