OpenAI 发布 GPT-6 Astra,性能破纪录并引发 AGI 之争
OpenAI 于 9 月 3 日发布新旗舰模型 GPT-6 Astra,并确认此前传闻中的「Astra」即为该模型,总裁 Greg Brockman 正在逐步 rollout。模型定位为长时程、端到端的「电脑操作」agent,基准成绩与实测口碑均属当前最强梯队,但「AGI 时代」的官方定调也引发了能力标签之争,是本轮 AI 竞争的标志性节点。
已确认
- OpenAI 确认 Astra 即 GPT-6,Greg Brockman 在发布会结尾以「welcome to the AGI era」定调,ThursdAI 播客用近一个半小时对其做了完整拆解,嘉宾围绕这句话与跑分展开辩论,Chollet 仍不认可 AGI 宣告。
- 模型能力覆盖推理、视觉、编码、计算机控制、网页与文件搜索、shell、MCP 等,可自行上网做研究、在应用和软件内操作、构建网站或应用、整理文档和幻灯片,并在几乎没有指导下独立完成多步骤任务。
- 基准表现方面,AI Explained 在近 22 分钟长视频中系统解析其在 ARC-AGI 3、FrontierMath、Agents Last Exam 等基准上的成绩;Epoch 指数达 169,打破纪录。
- 早期用户 ivanbezdomny 实测约一天后评价:这是他用过的最聪明的实用模型,重构代码时比以往 OpenAI 或 Anthropic 的模型更有条理、更深思熟虑、更不烦人,能持续推进任务不轻易放弃,编码场景几乎无需换用其他模型。
- Scobleizer 汇总的 X 早期讨论中,公认最强的能力是 3D 建模与跨应用长任务。
尚未确认
- ARC-AGI-3 存在 99.9% 与 62.7% 两种口径的成绩之争,johnseach 指出这一分歧,具体口径有待官方澄清。
- Reddit 转述的部分功能描述(如几乎零指导完成任务)最初未经官方渠道核实,后经发布会部分印证。
为什么重要
- 能力跃升是真的:多位独立评测者与播客讨论均认可其在 agent、编码、长任务上的实用强度,OpenAI 自己也表达了对模型能力的担忧(AI Explained 的分析主题)。
- AGI 标签则存争议:johnseach 认为能力跃升是真实的,但「AGI」标签不是;Chollet 等研究者的保留态度显示学界与厂商话语的分歧。
- ivanbezdomny 提示其推理过程更难被监督,长时程自主 agent 的可解释性与安全性问题随能力同步放大。
2026-09-04 ~ 2026-09-06 · 8 条相关
- 第 1 集:OpenAI 发布 GPT-6 Astra,性能破纪录并引发 AGI 之争(2026-09-04,8 条)
- 第 2 集:开发者称 GPT-6 Astra 五分钟找出176倍代码提速(2026-09-05,2 条)
- 第 3 集:曝 OpenAI Astra 训练动用超 10 万枚 GPU(2026-09-05,2 条)
- 第 4 集:GPT-6 Astra 实测:前端与长程任务能力大跃进(2026-09-06,2 条)
- 第 5 集:开发者实测称 OpenAI Astra 是唯一能推进超复杂项目的模型(2026-09-06,2 条)
- 第 6 集:GPT-6 Astra 被曝完全自主通关《Portal》(2026-09-06,2 条)
一手来源
- GPT-6 Astra 深度拆解:Greg Brockman 宣告「AGI 时代到来」 — thursdai_pod ·
- GPT-6 Astra 引爆 AGI 争论:ARC-AGI-3 成绩 99.9% 与 62.7% 的口径之争 — johnseach ·
- 开发者实测 GPT-6 Astra 一天:重构代码更聪明,编码几乎无需换模型 — ivan_bezdomny ·
- AI Explained 深度解析 GPT-6 Astra:能力强到 OpenAI 自己都担忧 — AI Explained · 2026-09-04
- Greg Brockman 以「欢迎来到 AGI 时代」为 GPT-6 发布会收尾 — thursdai_pod · 2026-09-05
- 【源头】GPT-6 Astra 深度拆解:Greg Brockman 宣告「AGI 时代到来」 — thursdai_pod · 2026-09-05
- GPT-6 Astra 首发盘点:X 上公认最强的是 3D 建模与跨应用长任务 — Scobleizer · 2026-09-06
- GPT-6 Astra 发布:Epoch 指数 169 破纪录,但推理过程更难被监督 — ivan_bezdomny · 2026-09-06
- 【源头】开发者实测 GPT-6 Astra 一天:重构代码更聪明,编码几乎无需换模型 — ivan_bezdomny · 2026-09-06
- OpenAI 发布迄今最强模型 GPT-6 Astra:可自主上网、建站、做任务 — CreamHoliday4754 · 2026-09-06
- 【源头】GPT-6 Astra 引爆 AGI 争论:ARC-AGI-3 成绩 99.9% 与 62.7% 的口径之争 — johnseach · 2026-09-06