Dietterich 详解系统安全定义:危害须控制在社会可接受水平
tdietterich · x · 2026-09-23
AI 安全领域知名学者 Thomas Dietterich 在与 David Manheim 等人的讨论中给出「安全系统」的定义:系统对人和基础设施的危害维持在低于社会可接受水平的范围内。他引用 Leveson 的动态安全理论指出,即便面对预算削减、人员变动、环境变化等扰动,这一标准也必须持续达成。这一定义框架为当前关于「安全」与「对齐」术语之争提供了参照。
所属事件:对齐圈激辩:动态安全是否等同于 AI 对齐(6 条相关)→
「漫话AGI」频道最新
- EA 该当顾问还是法律?两位圈内人激辩有效利他主义边界 — NathanpmYoung · 2026-09-23
- 知识尽在 AI,大学价值何在?作者主张寄宿式教育是答案 — begusgasper · 2026-09-23
- AGI 后人类必然被超越?研究者驳斥「人类永居价值顶端」论 — danfaggella · 2026-09-23
- 模型狂刷 Lean 引理证明,数学家即将迎来最难时刻 — ctjlewis · 2026-09-23
- Suleyman 重提旧文:AI 全球治理须让科技公司上桌 — mustafasuleyman · 2026-09-23
- 研究员论证:堆并行 agent 是弱路径,RSI 需要更强 agent — gleech · 2026-09-23