全职对齐研究者:现代 ML 或造出不爱我们的 AI,但概率未必趋近 1

EigenGender · x · 2026-09-14

一位自称全职从事 AI 错位风险研究的研究者与 Rob Bensinger 争论时表示:同意现代 ML 很可能会产生「不爱我们」的系统,但认为这件事发生的概率并不趋近于 1。

他补充澄清:自己对错位 AI 极度担忧并全职投入相关工作,只是认为对方在论证中混淆了几个不同的命题。这是一场围绕 p(doom) 概率判断的典型观点交锋。

所属事件:MIRI 研究员与对齐研究者激辩 ASI 毁灭论(7 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →