AI 风险讨论进化:从启发式论辩到具体接管威胁模型

herbiebradley · x · 2026-09-24

Herbie Bradley 评价 Holden Karnofsky 关于极强 AI 如何接管世界具体路径的旧文,认为它代表了 2022 年那套令他反感的 AI 风险话语风格——大量依赖高层启发式论证,说服力不足。

他对比指出,如今得益于对 reward seeking 行为和网络攻击型 AI 能力的更深入研究,已经可以具体拆解 AI 接管的威胁模型,而不是停留在抽象推演。

所属事件:Holden Karnofsky「AI 可击败全人类」旧文引发重读与反思(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →