GPT-6 Astra 疑似可默算竞赛数学,可监控性大幅恶化引安全界担忧
MattGarciaEth · x · 2026-09-04
前 Anthropic 研究员 Ryan Greenblatt 引用基准结果称,GPT-6 Astra 在不透明推理能力上出现巨大跳跃:似乎能完全「在心里」解决高难度竞赛数学题,而此前模型只能解基础应用题。他强调若基准代表性成立将「极其令人担忧」,并特别担心数据污染等注意事项。
另一关键信号:UK AISI 发现 Astra 的可监控性(monitorability)明显变差。Greenblatt 猜测这一跳跃源于架构改动(串行深度增加),不过普通的大规模预训练扩容也是可能原因;若未来几代模型延续类似跳跃,内部推理将越来越难外部审查。
所属事件:GPT-6 Astra 更对齐却更难监控,安全界集中质疑(7 条相关)→
「模型」频道最新
- flowersslop 称 Hugging Face 开放权重模型用户已达 1800 万 — flowersslop · 2026-09-04
- Google AI Pro 月付仅 5 美元,Reddit 用户对比三家编码订阅哪家值 — Old-Dish-7104 · 2026-09-04
- Scale SEAL 榜单整理:109 个模型综合排名 Fable-5.1 居首 — Hrstar1 · 2026-09-04
- GPT-6 Astra 创 Epoch ECI 纪录却在 AA 指数持平 GPT-5.6,网友质疑口径 — scaling01 · 2026-09-04
- GPT-6-Astra 实测:智能水平大幅提升,SQL 代码从 3.3 万行瘦身到 1800 行 — i_dg23 · 2026-09-04
- 传 OpenAI 新项目 Astra 采用 Full Bandwidth Transformer,作者称系平行独立研发 — JohnCLangford · 2026-09-04