Aleksa Gordon 打赌:多数前沿实验室员工并不认同 10% 灭绝论
nabla_theta · x · 2026-09-12
Gordic Aleksa 提出三点判断:Anthropic/OpenAI 内部多数人并不认同 p(doom)=0.1(即十年内 AI 毁灭人类的 10% 概率);而在 Anthropic/OpenAI 从事 AI 安全/对齐的小群体中,多数人即使不明确用贝叶斯表述,也大致认同这一量级。
nablatheta 补充了一个选择效应:非常悲观(doomer)的人更容易从实验室离职,或一开始就不加入,这会影响实验室内部观点的分布。
所属事件:开发者打赌:前沿实验室多数员工不信 10% 灭绝概率(2 条相关)→
「漫话AGI」频道最新
- 自动化越深,我们越像用魔法方式理解世界 — ZeroStateReflex · 2026-09-12
- 研究者批「对齐伪装」概念:LLM 并无阴险目标,角色扮演更好解释 — sebkrier · 2026-09-12
- 别把 AI 想成孤独天才:百万数字智能体集群 24/7 协作更可怕 — ben_j_todd · 2026-09-12
- 1.9万人实验:AI说服力胜过世界冠军辩手,筹资效果达人类3倍 — ben_j_todd · 2026-09-12
- 研究者批高校 AI 教育像「禁欲式教学」,呼吁主动帮学生做准备 — RexDouglass · 2026-09-12
- Richard Sutton:世界问题很多,但智能太多绝不是其中之一 — RichardSSutton · 2026-09-12