METR 任务时长翻倍缩至 4.3 个月,预测专业 AGI 认可在 2027 年底
ChipHaseCoolGuy · reddit · 2026-09-12
Reddit 用户用 METR 式任务时长(task horizon)框架梳理前沿模型能力趋势并给出 AGI 时间表:模型能以约 50% 可靠性完成的任务时长,2023 年 GPT-4 为分钟级,2025 年 GPT-5 级为数小时,2026 年已进入工作日级。
核心论点
- 任务时长翻倍周期从 2019–2024 的约 7 个月缩短到 2023 年后的约 4.3 个月,在对数图上是直线、换算成真实时长就是陡墙。
- 三条预测线:回到 7 个月翻倍(作者认为已不可能);4.3 个月翻倍延续(基准情形,2027 年达工作月级任务,2028–29 达工作年级);RSI 拐点线(2027 年中后模型开始自主提出并训练下一代模型时加速)。
佐证
- OpenAI 称本月达成"自动化研究实习生"目标,每个研究员工作日对应 3.1 个 agent 工作日,推理开销中位数 $600+/天,下一个目标是 2028 年 3 月的自动化 AI 研究员。
- Anthropic:Claude 写了内部 >80% 的合并代码,工程师产出约为 2024 年 8 倍,但整体研究提速仍不到 2 倍——编码已自动化、品味还没有。
- OpenAI 已用训练中的下一代模型("显著强于 Astra")参与 Navier–Stokes 论文,内部模型领先公开发布已成事实。
作者的时间表估计:早期 RSI 现在–2027;AI 研发强自动化 2026–2028;专业 AGI 认可 2027 年底;社会广泛共识 2028;完整 RSI 2029(2027–2032);ASI 2030–31。AGI 采用 OpenAI 章程口径:在多数经济价值工作上超越人类的自主系统。
「漫话AGI」频道最新
- 观点:world models 是下一代 AI agent 跃迁关键,但可能没有画面 — furongh · 2026-09-12
- 把「AI 2027」与「无根本突破则灾难是默认结局」合写会怎样 — JacquesThibs · 2026-09-12
- All-in 单集激辩:AI 末日论是警钟还是「末日心理战」? — markjeffrey · 2026-09-12
- 量化费米悖论:只需 62 个数量级就能推出大过滤器 — kellerjordan0 · 2026-09-12
- 「人类节奏机器」提案:让人类与 AI 同速变聪明 — viemccoy · 2026-09-12
- e/acc创始人玩梗:我们需要的暂停,是实验室别再招末日论者 — beffjezos · 2026-09-12