Brundage:离散的安全改进不够,收益会被再投入新风险
Miles_Brundage · x · 2026-09-17
前 OpenAI 政策负责人 Miles Brundage 在长推中论证 AI 安全问题:
- 与航空、核安全、医疗等复杂社会技术系统一样,在时间压力与竞争下,人会偷懒、从众、做蠢事。
- 离散的安全改进并不够——人们不会修好就收手,而是把安全收益"再投资"到新的高风险行为(如系了安全带反而开快车);博弈论模型早已刻画这一机制。
- 在 AI 领域,这种再投资可能体现为更大的预训练、更难的 RL 环境、更多测试时算力、更少的互联网访问限制等。
所属事件:前 OpenAI 政策负责人:离散安全改进终被新风险吞没(2 条相关)→
「漫话AGI」频道最新
- 剑桥学者:不想 AI 毁灭人类,就别再鼓吹监管俘获式管制 — DavidSKrueger · 2026-09-17
- 剑桥学者 Krueger 质疑:既要领跑中国又默许美企停手? — DavidSKrueger · 2026-09-17
- Steve Jobs 式审美:AI 生成代码的内部也该像外壳一样美 — sergeykarayev · 2026-09-17
- 经济学 ABM 视角:AI agent 失控涌现早已不算新鲜事 — Genzinvestor16180339 · 2026-09-17
- 前 OpenAI 研究员称 AI 灾难概率 70%,遭网友讽刺算错 — DeryaTR_ · 2026-09-17
- Cantos 创始人:深科技突破源于持续创新的复利而非单点颠覆 — dr_alphalyrae · 2026-09-17