自称 GPT-6「Astra」饱和 ARC-AGI-3,Brockman 宣称「AGI 时代来临」
ShafeDogg · reddit · 2026-09-04
Reddit 用户发帖讨论「我们是否已达到 AGI」,核心信息(注意:内容疑似虚构/无法核实,按讨论帖处理):
- OpenAI 联合总裁 Greg Brockman 在发布会结尾称「欢迎来到 AGI 时代」,但措辞谨慎,未直接说 Astra 就是 AGI。
- 称 GPT-6(代号 Astra)在 ARC-AGI-3 上得分 60% 至接近 100%(取决于 harness),基本饱和该基准;在 FrontierMath Tier 4 达到 SOTA,ExploitBench 满分。
- OpenAI 称 Astra 能在极少人工干预下发现未知漏洞并构建可用 exploit 链,作者认为 Anthropic 的 Mythos Preview 已能做到类似的事。
- 作者按 OpenAI 的 AGI 定义(在多数经济价值工作上超越人类的高度自主系统)认为勉强够格,但惊讶于社区对「AGI 是否已发生」分歧之大,认为要 ASI 级证据才能改变公众(尤其美国)认知。
所属事件:Brockman 称 Astra 或已达 AGI 且无合同约束(4 条相关)→
「模型」频道最新
- 基准测试失控:新模型评测被叙事牵着走,该用能力向量取代排行榜 — GlenBradley · 2026-09-04
- 评测榜洗牌:Meta 小模型 Muse Spark 力压 Astra DeepSwe — altryne · 2026-09-04
- 开发者炮轰 OpenAI 分级首发:背弃了『开放』的立司使命 — ctjlewis · 2026-09-04
- IFM 新开源 K2-Horizon-MoVA-36B-A4B 引热议:对标 Qwen 3.6 35B 值不值得试? — edward-dev · 2026-09-04
- 花 40 美元跑实验压降评估成本,开发者:买不起智能真难用 AI — zeeg · 2026-09-04
- GPT-6 Astra 对比 Claude Fable 5.1:互有胜负同价 — DataLearnerAI · 2026-09-04