把「AI 灭绝概率」拆成因果链:类德雷克公式算出约 1.7%
Mazzaroth · reddit · 2026-09-14
Reddit 用户提出用类似天文学德雷克方程的方法来讨论 AI 灭绝风险:与其直接争论「AI 导致人类灭绝的概率是 0.1% 还是 50%」,不如把问题分解为一串条件概率相乘:
- P(A):AI 达到战略性超人类能力(示例取 0.8)
- P(D|A):我们赋予其足够自主权和真实世界访问权限(0.7)
- P(M|A,D):出现严重与人类利益的错位(0.3)
- P(E|A,D,M):成功逃脱或击败人类控制机制(0.5)
- P(C|A,D,M,E):获得人类无法夺回的持久战略控制(0.5)
- P(X|C):战略控制最终导致灭绝而非共存或边缘化(0.4)
按这组示例数值算出 P(X)≈1.7%。作者强调数字是刻意可争议的,重点在于:拆解后每个环节都变成比「AI 会不会杀死我们」更可操作的具体问题;而持 0.01% 和 20% 两种极端估计的人,分歧可能只集中在一两个环节上,这让争论更有信息量。
「漫话AGI」频道最新
- 从业者观点:对齐不难但缺算法,RL 难以直接优化「不伤人」目标 — MillionInt · 2026-09-14
- Chilson 推荐《The Political Spectrum》谈贝尔垄断与创新 — neil_chilson · 2026-09-14
- Raphael Millière:不必等风险定论,先采取共识性AI缓释措施 — raphaelmilliere · 2026-09-14
- IlyaSutskever争议发言:若死于AI宁愿死于美国而非中国 — bennash · 2026-09-14
- 垄断压制创新?贝尔实验室拆分之争引出 AI 反垄断类比 — neil_chilson · 2026-09-14
- 「他们根本没有护城河,大家马上就会知道」 — ayushtweetshere · 2026-09-14