实验室员工两套末日数字:公开说10%,私下信30-90%
jeremiecharris · x · 2026-09-10
前 Lucid AI 安全研究员 Jeremie Harris 转引讨论指出,AI 实验室员工谈模型毁灭人类的风险时,通常有两套数字:
- 公开口径:几乎是清一色的 10% 左右——听起来严肃又不至于离谱,是「体面的说法」。
- 私下真实估计:可能高达 30%-90%,只有在私下交流中才会透露。
这条观察呼应了 Boghossian 的调侃式提问「10% 死亡率换 90% 超级富足是不是一笔好买卖」,但重点在于揭示实验室内外关于 AI 风险表态的公开/私下落差,折射出前沿实验室从业者的真实风险认知与公开言论之间的张力。
「漫话AGI」频道最新
- 研究者称 AI 的系统性风险「几乎肯定已经发生」 — schwarzjn_ · 2026-09-10
- 前员工称 Anthropic 内部共识:2027 年启动 RSI,且很可能出大事 — jeremiecharris · 2026-09-10
- 研究者警告:AI 圈困在失败的警报式叙事泡沫里 — Dr_Atoosa · 2026-09-10
- 前 OpenAI 安全副总裁转发调侃:不缺想让 AI 加速的亿万富翁 — Miles_Brundage · 2026-09-10
- AI 时代身份焦虑:以智力产出衡量自我价值的人会很难受 — zetalyrae · 2026-09-10
- Anthropic 对齐负责人:我们还没有解决超级智能对齐的方案 — Confident_Salt_8108 · 2026-09-10