为何 Kokotajlo 举报未能掀起 AI 安全连锁反应?Coxon 成压垮骆驼者
danfaggella · x · 2026-10-06
作者 danfaggella 提出问题:为什么 Kokotajlo 的举报没能引发实验室内部的 AI 安全「偏好级联」(preference cascade)?他的判断是:实验室员工当时的恐惧还不够,否认情绪太重;而级联何时爆发像摇晃过的汽水罐,你永远不知道何时会真正「砰」地弹开——没人料到会是 Coxon 扳动了扳机。这与同期纽约市议会举报人听证相呼应,反映前沿实验室内部安全关切正在快速公开化。
「漫话AGI」频道最新
- 社科一半助理教授岗位要求做 AI 研究,学界跟风滞后引吐槽 — RexDouglass · 2026-10-06
- 纽约时报专栏:Ada Lovelace 早已回答了关于 AI 的核心问题 — nytopinion · 2026-10-06
- AI 替你动脑后,"大脑健身房"会像健身房一样普及吗 — birchlse · 2026-10-06
- threepointone 谈「开源之死」:代码仓库将取代知识沉淀 — threepointone · 2026-10-06
- 研究者困惑:为何没有机构做真正的开放式对齐科学 — sebkrier · 2026-10-06
- 数学界缺乏实证传统,费马奖千份错误证明暴露领域盲区 — RexDouglass · 2026-10-06