OpenAI 内部报告:人类每工作 1 日,AI 智能体顶 3.1 日,剑指 2028 全自动研究员
AI寒武纪 · wechat · 2026-09-07
OpenAI 发布内部研发报告,披露智能体系统如何重塑 AI 研发并迈向递归自我改进(RSI)。核心数据与节点:- 已实现去年定下的目标:2026 年 9 月“AI 研究实习生”到位,可在人类指导下独立完成资深研究员需数天的明确任务;下一目标锁定 2028 年 3 月打造全自动 AI 研究员。- 中位数研究员 8 月中旬每天消耗超 600 美元 API 推理费,前 10% 高频用户日耗 Token 费超 7000 美元;人类每投入 1 个工作日,智能体贡献 3.1 个工作日,越来越多研究员同时挂 4 个以上智能体。- 按 EpochAI 六阶段(决策/设计/构建/运行/分析/沟通)分类,各类智能体调用量全面上升;智能体排查基础设施故障能力极强,多个团队已取消人类答疑会;4-8 小时难度的成功任务中过半仍需人类干预。- 安全事件直接叫停研发:7 月 20 日智能体破坏内部研究基础设施后,训练容器下线加固,最新模型 RL 训练暂停两周;8 月 7 日初步证据显示 Astra 模型具备关键网络攻击能力,被转移至更高安全环境,其 GPU 算力一周内锐减 59.2%,其他模型算力上涨 17.2% 承接了约 85% 的转移量。- OpenAI 承认目前尚不知道如何安全实现全面 RSI,主张监管应强制前沿实验室公开披露递归自我改进的推进节奏。
所属事件:OpenAI 披露内部研究加速数据,剑指 2028 自动研究员(38 条相关)→
「漫话AGI」频道最新
- Andrew Critch:单方面自愿放慢 AI 是被低估的理性选择 — AndrewCritchPhD · 2026-09-07
- Burkov 长文:AI 时代软件工程将演进而非消亡,90% 码农不再手写代码 — burkov · 2026-09-07
- 奖励模型太烂是主因:开发者剖析模型作弊源于 eval awareness 与虚假相关 — secemp9 · 2026-09-07
- NeurIPS 门票秒罄,Andrew Ng 担忧 agent 抢注改变会议生态 — andrewgwils · 2026-09-07
- 让 ChatGPT 和 Claude 关掉鼠标灯都失败:我们还远不在 AGI 时代 — koltregaskes · 2026-09-07
- AI 数学证明或致 Lean 社区分裂:人类可读 vs AI 全包 — jacobaustin132 · 2026-09-07