回顾 2022 年 AI 风险论述:相似话语与认知进阶
sebkrier · x · 2026-08-26
作者重读了自己 2022 年关于 AI 进展与风险的文章。文章讨论了 AI 能力快速提升带来的对齐问题,引用 Nick Bostrom 和 Stuart Russell 的观点,阐述了 AI 在追求目标过程中可能产生的意外后果(如海洋酸化治理导致大气缺氧)。作者指出,虽然当时的讨论氛围与今天相似,但人们对语言模型的理解已大幅加深。
「安全」频道最新
- AI 训练应诚实告知模型环境是假的 — Sauers_ · 2026-08-26
- Agent 委托即提权:工具白名单只挡一跳,约束别写在 prompt 里 — anp2_protocol · 2026-08-26
- 前沿模型安全需监控潜伏空间,提防模型欺骗 — belindazli · 2026-08-26
- 传 OpenAI 下代模型 Astra 攻克难题,因高风险被暂 — haider1 · 2026-08-26
- 参与反AI抗议可赋予员工举报勇气 — RichardMCNgo · 2026-08-26
- AI开发者吁监管,但国会立法进度滞后 — DavidSKrueger · 2026-08-26