前OpenAI研究员称推迟ASI一年可显著降低失控风险
前OpenAI安全研究员Ryan Greenblatt近日探讨了为降低超级智能(ASI)失控接管风险而推迟其到来的利弊。在假设中美达成稳定协议的前提下,他提出了一个量化估算:合理的集体人类偏好可能会认为,每年承受0.25%的延迟代价以换取安全性的提升是值得的。该研究为AI对齐问题及如何权衡ASI发展提供了全新的量化视角。
2026-08-12 ~ 2026-08-12 · 2 条相关
- 为降低AI失控风险,推迟ASI一年值不值? — RyanGreenblatt · 2026-08-12
- 权衡 ASI 风险:每年延迟 0.25% 可降低 AI 失控概率 — DKokotajlo · 2026-08-12