OpenAI 发布 GPT-6 Astra 并宣告 AGI 时代,实测跃升与争议并存
OpenAI 于 9 月 3 日发布传闻中的 Astra,确认其即为 GPT-6,总裁 Greg Brockman 在发布会上以「welcome to the AGI era」收尾,引发业界对 AGI 宣告的激烈争论。早期用户实测普遍认为这是能力上的一次真实跃升,尤其在长程 agent 任务、编码与前端上,但「AGI」标签与部分基准口径受到质疑。
已确认
- OpenAI 官方确认 Astra 即 GPT-6,Greg Brockman 宣告「AGI 时代到来」,模型正在 rollout(m9、m14、m18)。
- 基准表现:Epoch 指数 169 破纪录(m15);博主 htihle 评测显示 Astra(high 档)在 WeirdML 拿到 92.9%,与 Fable 5.1(max 档)并列第一,并在 17 个任务中的 6 个创下单项最高分,且生成的代码量显著更少(m17)。AI Explained 发布近 22 分钟视频,梳理其在 ARC-AGI 3、FrontierMath、Agents Last Exam 等基准上的表现,并称模型能力强到 OpenAI 自己都感到担忧(m1)。
- 第三方实测演示密集涌现:WorldofAI 汇总的用例显示 Astra 约 30 分钟内做出类《使命召唤》游戏、复刻宝可梦式玩法、在 Blender 中生成未来感城市,并出现操控电脑与机器人的演示(m3)。
- 多位早期用户给出正面实测:ivanbezdomny 称其为用过的最聪明的实用编码模型,重构代码比以往 OpenAI 或 Anthropic 模型更有条理、更不烦人,编码几乎无需换模型(m15、m16);BLUECOW009 称在引导下 Astra 似乎能一轮运行解决他发现的任何问题(m12);cneuralnetwork 反馈速度快、懂 skills、找 bug 强(m13);vista8 认为是 GPT-4、Claude Sonnet 3.5 之后首次感受到模型「突然变聪明」,认为 Altman「摸到 AGI 的边」有可能(m14)。
- YuchenjUW 实测称 Astra 修复了 GPT 系列最大短板——前端能力,在设计感、一次生成游戏、工具/电脑使用上优于 Fable 5.1,并考虑退订其中一家订阅(m5);EXM7777 在真实业务中反馈其自主设定目标、指挥 subagent 做长程工作能力极强,交谈体验有 Opus 4.5 的感觉(m7);Scobleizer 汇总 X 上讨论,认为公认最强的是 3D 建模与跨应用长任务(m6)。
尚未确认
- Reddit 转述称 Astra 可自主上网、建站、做任务(m4),消息未经官方渠道核实,但与 m3 汇总的第三方演示基本吻合。
- ARC-AGI-3 存在 99.9% 与 62.7% 的口径之争;johnseach 认为能力跃升是真的但 AGI 标签不是,并指出推理过程更难被监督(m18);ThursdAI 嘉宾中 Chollet 仍不认可 AGI 宣告(m9、m10)。
- 用户间评价存在分歧:ZenenoDev 首日实测结论是「高智力、低直觉」,认为 Astra 不理解现有架构与实现意图,或弃用回退 Sol 5.6(m2);haider1 认为预训练(世界建模、数学/抽象、空间与视觉推理)几乎全面领先,但代码仅小幅领先 Fable 5.1(m8);bookwormengr 实测 computer use 做一页勾股定理 PPT 耗时近 15 分钟,虽整体评价偏正面但速度存疑(m11)。
为什么重要
- 这是 OpenAI 首次以「AGI 时代」为旗舰模型定调,直接挑动业界对 AGI 定义的争论;无论标签是否成立,模型在长程 agent 任务、编码与前端上的实测跃升已足以影响开发者工具选型与订阅决策(如 m5 提到考虑退订一家)。同时推理过程更难被监督(m18)以及模型强大到官方自感担忧的说法(m1)也带来新的安全性关注点。
2026-09-04 ~ 2026-09-06 · 18 条相关
- 第 1 集:OpenAI 发布 GPT-6 Astra 并宣告 AGI 时代,实测跃升与争议并存(2026-09-04,18 条)
- 第 2 集:开发者称 GPT-6 Astra 五分钟找出176倍代码提速(2026-09-05,2 条)
- 第 3 集:曝 OpenAI Astra 训练动用超 10 万枚 GPU(2026-09-05,2 条)
- 第 4 集:GPT-6 Astra 机器人控制得分 95%,成本仅前代 43%(2026-09-05,5 条)
- 第 5 集:GPT-6-Astra 登顶 MathArena 数学基准(2026-09-06,2 条)
- 第 6 集:传闻中的 GPT-6 Astra 基准数据曝光(2026-09-06,2 条)
- 第 7 集:开发者实测称 OpenAI Astra 是唯一能推进超复杂项目的模型(2026-09-06,2 条)
- 第 8 集:GPT-6 Astra 被曝完全自主通关《Portal》(2026-09-06,2 条)
一手来源
- Greg Brockman 以「欢迎来到 AGI 时代」为 GPT-6 发布会收尾 — thursdai_pod ·
- GPT-6 Astra 发布:Epoch 指数 169 破纪录,但推理过程更难被监督 — ivan_bezdomny ·
- GPT-6 Astra 高分登顶 WeirdML,代码量却显著更少 — zainhas ·
- AI Explained 深度解析 GPT-6 Astra:能力强到 OpenAI 自己都担忧 — AI Explained · 2026-09-04
- 【源头】Greg Brockman 以「欢迎来到 AGI 时代」为 GPT-6 发布会收尾 — thursdai_pod · 2026-09-05
- GPT-6 Astra 深度拆解:Greg Brockman 宣告「AGI 时代到来」 — thursdai_pod · 2026-09-05
- 重度用户实测 Astra(GPT-6):智力更强但「不懂意图」,或弃用回退 Sol 5.6 — ZenenoDev · 2026-09-05
- 博主实测称 Astra 对话智能明显跃升,堪比 GPT-4 时刻 — vista8 · 2026-09-05
- GPT 6 Astra 上手首日:速度快、懂 skills、找 bug 强 — cneuralnetwork · 2026-09-05
- 【源头】GPT-6 Astra 高分登顶 WeirdML,代码量却显著更少 — zainhas · 2026-09-05
- 实测 GPT-6 Astra:前端能力大跃进,用户考虑退订一家 — Yuchenj_UW · 2026-09-06
- GPT-Astra 深度上手:长程目标管理极强,写作终于到位 — EXM7777 · 2026-09-06
- 开发者实测 GPT-6 Astra:一次运行就能解决发现的问题 — BLUECOW009 · 2026-09-06
- GPT-6 Astra 首发盘点:X 上公认最强的是 3D 建模与跨应用长任务 — Scobleizer · 2026-09-06
- 【源头】GPT-6 Astra 发布:Epoch 指数 169 破纪录,但推理过程更难被监督 — ivan_bezdomny · 2026-09-06
- 开发者实测 GPT-6 Astra 一天:重构代码更聪明,编码几乎无需换模型 — ivan_bezdomny · 2026-09-06
- OpenAI 发布迄今最强模型 GPT-6 Astra:可自主上网、建站、做任务 — CreamHoliday4754 · 2026-09-06
- 用户实测 OpenAI Astra 电脑操作:一道 PPT 任务耗时近 15 分钟 — bookwormengr · 2026-09-06
- GPT-6 Astra 引爆 AGI 争论:ARC-AGI-3 成绩 99.9% 与 62.7% 的口径之争 — johnseach · 2026-09-06
- 博主评 GPT-6 Astra:预训练大幅跃进,但代码仅小幅领先 Fable 5.1 — haider1 · 2026-09-06
- GPT-6 Astra 实测汇总:30 分钟做游戏、操控电脑与机器人 — WorldofAI · 2026-09-06