为何 Kokotajlo 举报未能掀起 AI 安全连锁反应?Coxon 成压垮骆驼者

danfaggella · x · 2026-10-06

作者 danfaggella 提出问题:为什么 Kokotajlo 的举报没能引发实验室内部的 AI 安全「偏好级联」(preference cascade)?他的判断是:实验室员工当时的恐惧还不够,否认情绪太重;而级联何时爆发像摇晃过的汽水罐,你永远不知道何时会真正「砰」地弹开——没人料到会是 Coxon 扳动了扳机。这与同期纽约市议会举报人听证相呼应,反映前沿实验室内部安全关切正在快速公开化。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →