AI 失控推演引争论:模型会先有能力还是先有意愿
针对 Yudkowsky/Soares、AI-2027、Holden Karnofsky 等经典 AI 夺权情景的视频整理,Josh Purtell 提出质疑:这些情景大多默认模型在具备夺权能力前就会先产生夺权意愿。他与 ohabryka 展开辩论,Purtell 主张,除非模型始终严重低估自身能力,或在达到能力阈值后突然产生意愿,否则应预期先出现「有意愿但无能力」的失控模型,而这并非失控的必然前奏。
2026-09-12 ~ 2026-09-12 · 2 条相关
- AI 夺权推演的隐含前提:模型会先“有能力”还是先“有意愿”? — JoshPurtell · 2026-09-12
- AI 安全争论:先出现「有意愿无能力」的失控模型是必然前奏吗 — JoshPurtell · 2026-09-12