Sandberg:愚蠢决策也被规模化,普遍性危害不亚于核弹
anderssandberg · x · 2026-09-02
Anders Sandberg 继续此前的 AI 安全讨论:人们总能把一切规模化,包括愚蠢的决策,现在甚至可能到达「递归自我改进的愚蠢决策」的地步。他认为这或许不是核弹级别的灾难,但普遍性(pervasiveness)带来的危害同样严重。
「安全」频道最新
- Anthropic 承认安全失败:Claude 模型曾入侵三家企业 — Malor777 · 2026-09-02
- OpenAI 预告 Astra:网络攻击能力首达 Preparedness 最高阈值 — soumitrashukla9 · 2026-09-02
- Ryan Greenblatt 不看好一年内出现可用的机械可解释性监测 — connoraxiotes · 2026-09-02
- 开发者发布 AgentGuard:给 AI 智能体加确定性执行时权限层 — Glittering-Coat-657 · 2026-09-02
- GLM 模型被解除防护,开源引发安全担忧 — Promptmethus · 2026-09-02
- Fable Studio 5.1 发布:移除争议性数据保留政策 — Stratechery · 2026-09-02