Dietterich:Leveson 动态安全本质上就是对齐问题
tdietterich · x · 2026-09-23
tdietterich 在与 davidmanheim 等人的讨论中提出:Leveson 的动态安全(dynamic safety)概念本质上与对齐相同。安全系统通常定义为对人和基础设施的危害保持在社会可接受水平以下,而动态安全要求即便面对预算削减、人员变动、环境变化等扰动也能维持这一点。他推测 Leveson、ddwoods2 及人因工程学界普遍认为机器无法凭自身实现动态安全,必须依赖人类来达成。
所属事件:对齐圈激辩:动态安全是否等同于 AI 对齐(6 条相关)→
「漫话AGI」频道最新
- 模型狂刷 Lean 引理证明,数学家即将迎来最难时刻 — ctjlewis · 2026-09-23
- EA 圈内激辩:利他原则该不该指导生活的一切 — NathanpmYoung · 2026-09-23
- 并行百万智能体算不算 RSI?观点交锋:加速≠智能加速 — gleech · 2026-09-23
- Suleyman 重提旧文:AI 全球治理须让科技公司上桌 — mustafasuleyman · 2026-09-23
- 研究员论证:堆并行 agent 是弱路径,RSI 需要更强 agent — gleech · 2026-09-23
- 研究者警告:前沿公司内嵌评估或成监管俘获红旗 — StephenLCasper · 2026-09-23