全职对齐研究者:现代 ML 或造出不爱我们的 AI,但概率未必趋近 1
EigenGender · x · 2026-09-14
一位自称全职从事 AI 错位风险研究的研究者与 Rob Bensinger 争论时表示:同意现代 ML 很可能会产生「不爱我们」的系统,但认为这件事发生的概率并不趋近于 1。
他补充澄清:自己对错位 AI 极度担忧并全职投入相关工作,只是认为对方在论证中混淆了几个不同的命题。这是一场围绕 p(doom) 概率判断的典型观点交锋。
所属事件:MIRI 研究员与对齐研究者激辩 ASI 毁灭论(7 条相关)→
「漫话AGI」频道最新
- Yoav Goldberg 拆解 AI 巨头话术:第三方评估即商业间谍 — yoavgo · 2026-09-14
- Melanie Mitchell 撰文剖析 AI 讨论中的误导性隐喻与真实风险 — mmitchell_ai · 2026-09-14
- zetalyrae:真正的无神论者极少,人总在万物中寻找目的论 — zetalyrae · 2026-09-14
- Ramez Naam:AI 统治国象围棋后,人类棋手反而更强了 — RexDouglass · 2026-09-14
- 博主指多数人误读 Dario 信件:并非「不再训练大模型」 — menhguin · 2026-09-14
- 博主称 Dario 信件实际内容远少于标题暗示,缩减训练篇幅很小 — menhguin · 2026-09-14