研究者称已部署的错位 AI 也难以夺权: takeover 实际不可行

JacquesThibs · x · 2026-09-25

在关于「已部署的错位 AI 是否构成威胁」的讨论中,作者承认广泛部署的错位 AI 值得担忧,「训练一个错位的后继模型」是可能路径之一,但他认为迄今没有人给出这类场景的详细威胁模型。

他本人的预期是:即使已部署的 AI 带有错位目标,takeover(夺权)在现实中不可行。他计划后续从技术对齐角度推演这类场景,并表示自己认为 AI 2027 报告在这一环节刻意含糊带过,缺乏说服力。

所属事件:AI 夺权之争:内部部署失准模型是否构成失控路径(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →