作者引 Bostrom 与 Russell 论证:AI 控制仍未走出假设阶段
AryHHAry · x · 2026-09-14
发帖人针对「AI 不受控就不值得追求」的原则指出:所谓控制目前只是工作假设,而非已完成的设计。其论证援引三类来源——Nick Bostrom 在 Minds and Machines(2012)中区分了智能与目标对齐,能力增强不等于自动更符人类意图;Stuart Russell 长期强调我们尚缺乏针对「能力超过监督者」的 agent 的健壮控制框架;2024 年发布的 superalignment 综述(arXiv,后经修订)仍将可扩展监督视为开放问题而非已解决的产品特性。
作者同时感慨 AI 实验室的「事故」越来越多且都不是小事,而科技巨头们自 2023 年以来反复上演相似剧情。
「漫话AGI」频道最新
- Bryan Johnson:不信任何 AI 风险评估,选择押注乐观未来 — QuanquanGu · 2026-09-14
- AGI 怀疑者该回答的问题:实验室真在逼近 AGI,你会期待他们怎么做? — AndyMasley · 2026-09-14
- 「科学为了什么」:当 AI 解决数学问题,改变的是人心智 — EdwardSun0909 · 2026-09-14
- 科技富豪扎堆买末日地堡,网友:有钱我也买图个安心 — AIandDesign · 2026-09-14
- Karpathy:RL 很糟但此前更糟,我们造的不是动物而是幽灵 — RileyRalmuto · 2026-09-14
- Scott Alexander 系统阐述慈善道德观,回应「溺水儿童」争议 — john__allard · 2026-09-14