作者引 Bostrom 与 Russell 论证:AI 控制仍未走出假设阶段

AryHHAry · x · 2026-09-14

发帖人针对「AI 不受控就不值得追求」的原则指出:所谓控制目前只是工作假设,而非已完成的设计。其论证援引三类来源——Nick Bostrom 在 Minds and Machines(2012)中区分了智能与目标对齐,能力增强不等于自动更符人类意图;Stuart Russell 长期强调我们尚缺乏针对「能力超过监督者」的 agent 的健壮控制框架;2024 年发布的 superalignment 综述(arXiv,后经修订)仍将可扩展监督视为开放问题而非已解决的产品特性。

作者同时感慨 AI 实验室的「事故」越来越多且都不是小事,而科技巨头们自 2023 年以来反复上演相似剧情。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →