jd_pressman 拆解 p(doom):称社会化倾向可化解回形针风险
jd_pressman · x · 2026-09-12
AI 安全研究者 jdpressman 重提他此前对 p(doom) 概念的批评,并以一套自嘲为「系统 1 低成本估算」的数字给出自己的风险画像:他认为「存在性无聊」概率高达 99%,拿不到「不死论者的豪华太空共产主义」的概率 50%,人类被当作炮灰消耗快于补充的概率约 33%。
在讨论中他提出一个相对乐观的论点:智能体向社会化发展的倾向,对「回形针最大化器」式末日是好消息——正如工具性价值扩张与社会动态共同塑造了超出人类哺乳动物初始价值盆地的复杂人类价值观,HF(human feedback)微调出的智能体本质上是一种「STEM AI」,有望通过类似机制发展出更复杂的价值结构。
「漫话AGI」频道最新
- 陶哲轩领衔25位菲尔兹奖得主联名公开信,回应OpenAI数学争议 — CtrlAltDwayne · 2026-09-12
- ASI不会情绪翻转,但Bing式模型像边缘人格者会局部在意 — jd_pressman · 2026-09-12
- Katja Grace 补发动画版 AI 生存风险论证资源 — KatjaGrace · 2026-09-12
- Katja Grace 上 NPR 播客,半小时讲透 AI 生存风险担忧 — KatjaGrace · 2026-09-12
- 陶哲轩谈 AI 与数学:别只做半截活,做到数学家无事可做 — RexDouglass · 2026-09-12
- Anthropic 离职研究员:中美不是对手,在共同面对外星物种 — whurley · 2026-09-12