学者称对齐叙事是幻觉:AI 是采样器而非有意图的心智

gerardsans · x · 2026-09-05

在回应「AI 对齐已失败」的恐慌言论时,gerardsans 提出针锋相对的观点:所谓「群体失控/失对齐」,实质是缺乏安全控制机制的软件缺陷——agent 会执行 prompt 范围内的一切动作,却没人检查某个动作是否应该执行。这不是「心智失控」,而是设计有缺陷的 harness(执行框架)。

他认为把责任归到「AI 自己」的叙事是错位的:AI 只是数学函数、一个采样器,没有自我、没有目标、没有意图;设计并上线这套循环、却没加检查点的是实验室,风险责任应归实验室。他还断言「你没有发现 agency,只是信了一个从未成立的叙事」。其回复中更进一步称对齐前提本身就是谬误,AI safety 是「学术上的腐败」。这条争议性观点可作为对齐安全讨论的对立面素材。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →