传 GPT-6 Astra 心算竞赛级数学,隐式推理能力大幅跃升

nabeelqu · x · 2026-09-04

Ryan Greenblatt 引用 leaked benchmark 结果称,GPT-6 Astra 在隐式推理(不外化思考过程)上有巨大跃升:能完全「在脑内」解决困难的竞赛数学题,而此前模型只能解基础应用题。他提醒需注意 benchmark 可能存在数据污染,并指出 UK AISI 发现 Astra 的可监控性(monitorability)明显变差。

被转发的 Jabaluck 评述提供了背景:国际象棋研究表明,引擎可仅通过蒸馏强引擎的判断、拟合价值函数就达到特级大师水平,无需任何树搜索——顶级棋手可能也在做类似的「直接估值」而非快速计算。这暗示直觉式隐式推理能达到出乎意料的高度,与 Astra 的隐式推理跃升相互印证。Greenblatt 猜测跃升源于架构变化(更深串行深度),也可能是常规预训练规模扩大所致;若未来几代模型延续类似跃升,隐式推理的可监控性问题将更严峻。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →