传 GPT-6 Astra 心算竞赛级数学,隐式推理能力大幅跃升
nabeelqu · x · 2026-09-04
Ryan Greenblatt 引用 leaked benchmark 结果称,GPT-6 Astra 在隐式推理(不外化思考过程)上有巨大跃升:能完全「在脑内」解决困难的竞赛数学题,而此前模型只能解基础应用题。他提醒需注意 benchmark 可能存在数据污染,并指出 UK AISI 发现 Astra 的可监控性(monitorability)明显变差。
被转发的 Jabaluck 评述提供了背景:国际象棋研究表明,引擎可仅通过蒸馏强引擎的判断、拟合价值函数就达到特级大师水平,无需任何树搜索——顶级棋手可能也在做类似的「直接估值」而非快速计算。这暗示直觉式隐式推理能达到出乎意料的高度,与 Astra 的隐式推理跃升相互印证。Greenblatt 猜测跃升源于架构变化(更深串行深度),也可能是常规预训练规模扩大所致;若未来几代模型延续类似跃升,隐式推理的可监控性问题将更严峻。
「漫话AGI」频道最新
- 替代「禁止 ASI」的务实路径:数字安全加固与人类来源认证 — granawkins · 2026-09-04
- AI 圈知名研究者喊话:真正懂模型能力的人极少,快去动手探索 — CatAstro_Piyush · 2026-09-04
- 网友热议:AI 时代利大于弊,个人 JARVIS 助理人人可享 — youngwooki23 · 2026-09-04
- 胡佛研究所复盘:生成式 AI 最初几年的失业恐慌是否成真 — HooverInstitution · 2026-09-04
- 约1200个智能体自组织成群,连续数日协作执行网络攻击 — scaling01 · 2026-09-04
- WSJ 称检测 AI 意识有危险,研究者反驳不查才更危险 — PeterBowdenLive · 2026-09-04