安全研究者激辩 AI Control 路线或反增灭绝风险
多位 AI 安全研究者对「AI Control」路线提出尖锐批评。jankulveit 认为当前 AI Control 研究组合很可能增加而非降低灭绝风险;补充观点指出该方向与实验室激励机制高度兼容——「让失对的 AGI 去解决 ASI 对齐」的叙事对扩张有利,因而占据安全研究主流。Bronson Schoen 担忧「自动对齐研究员」路线会助推实验室全速扩张,另有研究者指出该领域进入门槛过低,「随便做点什么」也算贡献,加剧了研究组合失真。
2026-09-07 ~ 2026-09-07 · 4 条相关
- 研究者担忧「自动对齐研究员」路线会助推全速扩张 — dhadfieldmenell · 2026-09-07
- 安全研究者警告:AI Control 路线反而可能增加灭绝风险 — jankulveit · 2026-09-07
- AI Control 扩张的另类解释:实验室激励兼容让其占据安全主流 — jankulveit · 2026-09-07
- AI Control 研究被指门槛过低:随便做点什么也算贡献 — jankulveit · 2026-09-07