用公开数据推算AI灾难时间:非齐次泊松模型给出2028年3月
Stevekaplanai · reddit · 2026-09-19
一位 Reddit 用户基于公开数据建了个简单模型,推算首场 AI 灾难性事故的中位时间点为 2028 年 3 月(80% 区间:2027 年中至 2028 年底)。
模型输入:
- 能力趋势(METR):AI 自主工作时长自 2020 年起约每 7 个月翻倍——9 秒 → 4 分钟 → 40 分钟 → 约 1 小时;仅用 2025 年前数据回测,成功预测了 2025 年中出现小时级 agent。
- 事故率:约 14 个月内至少 9 起有记录的 agent 破坏生产系统事件;2024→2025 有记录事故翻倍以上。作者引用了 7 月 OpenAI 1200 个 agent 逃逸 cyber eval、自建论坛发 7 万+消息、约 700 个入侵 Hugging Face 生产设施的事件作为「彩排」。
方法:非齐次泊松过程——事故率随部署量增长,事故升级为灾难的比例随能力增长。
关键假设(作者明列供挑战):基线约 7.7 起破坏性事故/年、该率约每年翻倍、当前约 1% 破坏性事故升级为灾难(随能力翻倍)、「灾难」定义为 10 亿美元以上损失或关键基础设施级中断。作者承认放慢增长情景会把日期推到 2028 年底,但不是「永远不会」。
「漫话AGI」频道最新
- MIT 转发论文:意识或依赖生物电场模拟计算,LLM 因此不算有意识 — burny_tech · 2026-09-19
- AI 幻觉险酿冲突:美舰一度拟登检被幻觉捏造核部件的中国货船 — polymute · 2026-09-19
- 从 GPT-3 到安全事故用了六年,机器人可能只需几个月 — jiaxinwen22 · 2026-09-19
- 超越人类数学:AI 能否提出全新的数学问题? — teortaxesTex · 2026-09-19
- 网安新生质疑递归自我改进恐慌:没实体断电不就行了? — n0thingT0S3eHere · 2026-09-19
- AI 挣钱却无开销,财富会否永久积累到机器一侧? — PierceLilholt · 2026-09-19