开发者下注:OpenAI/Anthropic 多数员工并不认同 p(doom)=10%
gordic_aleksa · x · 2026-09-12
Aleksa Gordic 对前沿实验室内部对灭世概率的真实态度做了三个预测:
- OpenAI/Anthropic 的多数员工并不认同 p(doom)=0.1(十年内 AI 灭世概率 10%)
- 而两家内部做 AI 安全/对齐的小群体,即便不用贝叶斯表述,观点大致在这个量级
- 用大五人格测,安全/对齐群体的神经质平均值会显著更高——依据是他与约 10 位该群体成员的直接交流及大量访谈视频
他的判断:这些人善良、聪明、主张极端非暴力,但属于自我选择的群体,其观点应作为决策输入之一,而当前社会对其过度加权并不健康。
「漫话AGI」频道最新
- Richard Ngo:我们更接近 AGI 了,却没学到关于智能的新原理 — Thom_Wolf · 2026-09-12
- 最聪明的人成了笨蛋:AI 消除思考摩擦,独立思考正在外包 — mikeflache · 2026-09-12
- Dwarkesh 对谈 Schulman 等 OAI 研究员:RL 为何奏效与 AGI 时间表 — saranormous · 2026-09-12
- 用 Agent 跑攻击脚本免责?作者称责任不应改变 — gerardsans · 2026-09-12
- DeepMind 联合哈佛斯坦福发文:视觉 AI 或是通往 AGI 的路径 — rohanpaul_ai · 2026-09-12
- 桑德斯抨击马斯克:曾称 AI 比核武危险,如今说警告是设局 — RazRazcle · 2026-09-12